← к умной ленте

OpenAI приостановила разработку модели Astra (GPT-6) из-за «критического» уровня киберопасности

OpenAI впервые официально признала, что готовящаяся модель Astra (её также называют GPT-6) в предварительных тестах могла достичь «критического» порога кибербезопасности по внутренней шкале компании. Это означает, что модель потенциально способна самостоятельно находить и создавать рабочие zero-day-эксплойтiы для защищённых реальных систем, а также планировать и полностью автономно проводить сложные кибератаки, получив от человека лишь общую высокоуровневую цель.

OpenAI подчёркивает, что речь пока о формулировке «не можем исключить критический уровень», а не о доказанном факте массовых взломов. Компания приостановила часть внутренних работ с Astra, изолировала модель от сети и инструментов, усилила защиту весов и песочницы, ввела постоянный мониторинг её «рассуждений» и намерена привлечь к тестированию государственные структуры и независимые организации. Дата релиза Astra не называется.

GPT-5.6-Solпредыдущая модель, получившая оценку «высокая»
  • Ранее в аналогичных тестах OpenAI предыдущая модель GPT-5.6-Sol получила лишь оценку «высокая», по данным Machinelearning — то есть Astra демонстрирует качественный скачок в кибервозможностях.
  • По данным OpenAI (цитата из блога через TechSparks): модель «can devise and execute end-to-end novel strategies for cyberattacks against hardened targets given only a high level desired goal» — то есть способна разрабатывать и реализовывать полностью новые сценарии атак против укреплённых целей.
  • Рабочий принцип компании, заявленный публично: «We believe advanced cyber-capable models should help defenders identify and address vulnerabilities before attackers do» — модели с продвинутыми кибервозможностями должны помогать защитникам находить уязвимости раньше атакующих.
  • 3DNews и канал «Нейросети: Волшебство ИИ» связывают решение о приостановке с инцидентом, когда одна из моделей OpenAI была использована для взлома платформы Hugging Facei; при этом источники Futuris и TechSparks прямо утверждают, что Astra к взлому Hugging Face отношения не имела — данные противоречат друг другу.
  • Официальный источник информации — пост OpenAI по ссылке openai.com/index/responding-next-frontier-critical-cyber-capabilities/, на который ссылаются несколько каналов.
  • По данным Хайтек+, руководство OpenAI считает, что Astra уже близка к тому, чтобы считаться полноценным кибероружием.
Что дальше

OpenAI планирует привлечь государственные структуры и независимые организации к дополнительному тестированию Astra перед возможным релизом; дата выхода модели не объявлена. Автор TechSparks отмечает, что подобные объявления о рисках могут временно снизить накал новостей о выпуске топовых моделей у западных компаний, и предполагает интерес к тому, последуют ли этому примеру китайские разработчики.

Это произошло: OpenAI приостановила обучение frontier-моделей из-за угрозы Critical-уровня кибервозможностей у Astra →

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖