OpenAI впервые официально признала, что готовящаяся модель Astra (её также называют GPT-6) в предварительных тестах могла достичь «критического» порога кибербезопасности по внутренней шкале компании. Это означает, что модель потенциально способна самостоятельно находить и создавать рабочие zero-day-эксплойтiы для защищённых реальных систем, а также планировать и полностью автономно проводить сложные кибератаки, получив от человека лишь общую высокоуровневую цель.
OpenAI подчёркивает, что речь пока о формулировке «не можем исключить критический уровень», а не о доказанном факте массовых взломов. Компания приостановила часть внутренних работ с Astra, изолировала модель от сети и инструментов, усилила защиту весов и песочницы, ввела постоянный мониторинг её «рассуждений» и намерена привлечь к тестированию государственные структуры и независимые организации. Дата релиза Astra не называется.
