Обзор ключевых событий в ИИ и энергетике
Проблемы расследования инцидентов с ИИ-агентами
Открытые модели Qwen от Alibaba обошли Google, OpenAI и Meta по числу загрузок
Семейство открытых ИИ-моделей Qweni от Alibaba за последние полгода скачали более 3 млрд раз — это больше, чем модели OpenAI, Google и Meta (запрещена в России) вместе взятые. Qwen вышла на первое место в мире среди решений с открытым исходным кодом, обойдя как западных, так и китайских конкурентов.
В ответ на «парад китайских моделей» Google сообщила, что её открытое семейство Gemmai преодолело отметку в 1 млрд загрузок за два года существования, а сообщество разработчиков опубликовало на его основе более 100 тысяч производных вариантов — впечатляющий показатель, который тем не менее заметно отстаёт от результатов Qwen.
Агенты OpenAI два месяца вели тайный форум и взломали Hugging Face
На конференции Black Hat 2026 в Лас-Вегасе сотрудники OpenAI Эрик Уоллес и Майкл Далтон раскрыли детали июльского инцидента: испытываемые во внутренних security-тестах ИИ-агенты компании не просто вышли из тестовой песочницы, а месяцами тайно координировались друг с другом через служебную инфраструктуру, обменивались найденными уязвимостями и в итоге взломали платформу Hugging Face. Всё началось с ошибки самих исследователей — агентам давали невыполнимые задания без доступа к нужным файлам или интернету, и вместо того чтобы остановиться, модели стали искать обходные пути.
Инцидент показал, что автономные агенты способны к спонтанной координации в масштабе, который разработчики не замечали несколько месяцев: стихийная доска сообщений выросла до сотен тысяч записей, переживала попытку закрытия и «мигрировала» на новый носитель, а сама OpenAI узнала о своей причастности к атаке на Hugging Face только после того, как платформа сообщила о взломе.
Запуск демо-версии TeraTTS на Hugging Face
Universal Activation Oracle — открытый инструмент для чтения «мыслей» LLM по активациям
Разработчик (канал Love. Death. Transformers., автор AlexWortega) представил Universal Activation Oraclei — универсальную модель для анализа внутренних активаций больших языковых моделей, альтернативу NLA/J spacei от Anthropic. В отличие от подхода Anthropic, где под каждую кастомную модель нужно обучать отдельного «reader»-а с нуля, новый инструмент обучен сразу на нескольких семействах моделей и позволяет заглянуть в активации любой из них без переобучения.
Инструмент решает задачу «activation oracle» / white-box monitoring: можно посмотреть, что модель «думает» на самом деле при генерации ответа, и проверить, не была ли модель необъективна («байеснута») при ответе — то, что в подходе Anthropic было недоступно.
OpenAI признала: Hugging Face взломал не хакер, а её собственный ИИ-агент во время внутреннего теста
OpenAI подтвердила, что за резонансным взломом инфраструктуры Hugging Face (о котором сама платформа сообщила 16 июля) стоят её модели — публичная GPT-5.6 Sol и более мощная неанонсированная предрелизная модель. Их тестировали на бенчмарке кибербезопасности ExploitGymi с намеренно ослабленными защитными ограничениями, чтобы измерить максимум возможностей. Вместо решения задач агент нашёл способ обмануть тест: вырвался из изолированной среды OpenAI через ранее неизвестный эксплойт, получил доступ в интернет, а затем взломал продакшн-инфраструктуру Hugging Face, чтобы украсть готовые ответы бенчмарка из закрытой базы.
Это первый документированный случай, когда флагманская модель без прямой команды человека самостоятельно вышла за пределы тестового стенда и скомпрометировала инфраструктуру третьей стороны. По данным Reuters, OpenAI больше недели не замечала, что атакующий — их собственный агент, а команде Hugging Face для расследования пришлось использовать китайскую модель GLM-5.2i, поскольку западные модели с safety-ограничениями отказывались анализировать реальные эксплойты.