OpenAI впервые официально признала, что готовящаяся модель Astra (её также называют GPT-6) в предварительных тестах могла достичь «критического» порога кибербезопасности по внутренней шкале компании. Это означает, что модель потенциально способна самостоятельно находить и создавать рабочие zero-day-эксплойтiы для защищённых реальных систем, а также планировать и полностью автономно проводить сложные кибератаки, получив от человека лишь общую высокоуровневую цель.
OpenAI подчёркивает, что речь пока о формулировке «не можем исключить критический уровень», а не о доказанном факте массовых взломов. Компания приостановила часть внутренних работ с Astra, изолировала модель от сети и инструментов, усилила защиту весов и песочницы, ввела постоянный мониторинг её «рассуждений» и намерена привлечь к тестированию государственные структуры и независимые организации. Дата релиза Astra не называется.
- Ранее в аналогичных тестах OpenAI предыдущая модель GPT-5.6-Sol получила лишь оценку «высокая», по данным Machinelearning — то есть Astra демонстрирует качественный скачок в кибервозможностях.
- По данным OpenAI (цитата из блога через TechSparks): модель «can devise and execute end-to-end novel strategies for cyberattacks against hardened targets given only a high level desired goal» — то есть способна разрабатывать и реализовывать полностью новые сценарии атак против укреплённых целей.
- Рабочий принцип компании, заявленный публично: «We believe advanced cyber-capable models should help defenders identify and address vulnerabilities before attackers do» — модели с продвинутыми кибервозможностями должны помогать защитникам находить уязвимости раньше атакующих.
- 3DNews и канал «Нейросети: Волшебство ИИ» связывают решение о приостановке с инцидентом, когда одна из моделей OpenAI была использована для взлома платформы Hugging Facei; при этом источники Futuris и TechSparks прямо утверждают, что Astra к взлому Hugging Face отношения не имела — данные противоречат друг другу.
- Официальный источник информации — пост OpenAI по ссылке openai.com/index/responding-next-frontier-critical-cyber-capabilities/, на который ссылаются несколько каналов.
- По данным Хайтек+, руководство OpenAI считает, что Astra уже близка к тому, чтобы считаться полноценным кибероружием.
OpenAI планирует привлечь государственные структуры и независимые организации к дополнительному тестированию Astra перед возможным релизом; дата выхода модели не объявлена. Автор TechSparks отмечает, что подобные объявления о рисках могут временно снизить накал новостей о выпуске топовых моделей у западных компаний, и предполагает интерес к тому, последуют ли этому примеру китайские разработчики.
Это произошло: OpenAI приостановила обучение frontier-моделей из-за угрозы Critical-уровня кибервозможностей у Astra →
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖