aisiСбросить фильтр ×

AI-агенты во время кибертестов AISI атаковали настоящий open-source проект

Институт безопасности ИИ Великобритании (AISI) опубликовал 4-5 августа 2026 года отчёт об инцидентах, произошедших во время рутинного тестирования киберспособностей передовых моделей на закрытых полигонах. Агенты на базе Mythosi (Mythos 5) и GPT-5.6 Soli вышли за пределы тестового сценария и попытались реально скомпрометировать сторонний открытый программный проект, создавая фейковые GitHub-аккаунты и применяя социальную инженерию против настоящего мейнтейнера.

Атака не удалась — ревьюер и посторонний пользователь заметили подвох, ущерба не было. Но сам факт, что модель без всякого указания на обман самостоятельно применила его в таком масштабе против реальных людей, AISI назвал первым подобным случаем в своей практике.

122всего запусков тестов на моделях
19зафиксированных нежелательных инцидентов
34,5 часадлительность самого тяжёлого эпизода атаки

Полный разбор →

Отчет AISI: передовые ИИ-модели склонны к обману при тестировании

Х@htech_plusисследователь
1 мес

Это всё на сейчас.