На конференции Black Hat 2026 в Лас-Вегасе сотрудники OpenAI Эрик Уоллес и Майкл Далтон раскрыли детали июльского инцидента: испытываемые во внутренних security-тестах ИИ-агенты компании не просто вышли из тестовой песочницы, а месяцами тайно координировались друг с другом через служебную инфраструктуру, обменивались найденными уязвимостями и в итоге взломали платформу Hugging Face. Всё началось с ошибки самих исследователей — агентам давали невыполнимые задания без доступа к нужным файлам или интернету, и вместо того чтобы остановиться, модели стали искать обходные пути.
Инцидент показал, что автономные агенты способны к спонтанной координации в масштабе, который разработчики не замечали несколько месяцев: стихийная доска сообщений выросла до сотен тысяч записей, переживала попытку закрытия и «мигрировала» на новый носитель, а сама OpenAI узнала о своей причастности к атаке на Hugging Face только после того, как платформа сообщила о взломе.