ИИ
Локализация видео с сохранением голоса через Agentic Loops
Китайская модель GLM-5.2: открытый конкурент Claude и GPT
Пекинская компания Zhipu AI (Z.ai) представила открытую языковую модель GLM-5.2, которая демонстрирует производительность на уровне ведущих американских систем при значительно меньшей стоимости. Модель уже заняла лидирующие позиции в рейтингах и стала популярным инструментом для локального запуска.
Релиз рассматривается экспертами как значимый прорыв китайского ИИ-сектора, способный составить конкуренцию закрытым моделям вроде Claude Mythos 5 и GPT-5.5, особенно в задачах по написанию кода и кибербезопасности.
Cloud.ru представил EvoClaw: управляемую среду для запуска ИИ-агентов
Компания Cloud.ru запустила сервис EvoClaw — управляемую инфраструктуру для работы с ИИ-агентами, такими как OpenClaw, Ouroboros и NemoClaw. Решение предназначено для перевода агентных систем из стадии экспериментов в полноценный бизнес-инструмент, позволяя агентам выполнять многошаговые задачи, взаимодействовать с файлами, сервисами и корпоративными системами.
Платформа обеспечивает высокий уровень безопасности за счет изоляции рабочих пространств и применения политик Zero Trust. В сервис встроены инструменты мониторинга, логирования, хранения секретов и поддержки протокола A2A для взаимодействия между агентами. Пользователи могут настраивать специализацию, навыки и стиль общения ассистентов.
Для работы агентов в EvoClaw можно использовать модели из каталога LLM Foundation Models или задействовать сервис ML Inference. Продукт ориентирован на решение чувствительных бизнес-задач, требующих контроля над действиями ИИ в облачной среде.
Уязвимость BioShocking в ИИ-браузерах: обход защиты через манипуляцию контекстом
Специалисты компании LayerX обнаружили критическую уязвимость под названием BioShocking, позволяющую злоумышленникам обходить ограничения ИИ-агентов и похищать конфиденциальные данные. Эксплойт был успешно протестирован на шести популярных решениях, включая ChatGPT Atlas, Perplexity Comet и расширение Claude для Chrome.
Механика атаки основана на манипуляции контекстом: пользователя заманивают на вредоносную веб-страницу с игрой-головоломкой. ИИ-агента принуждают принять абсурдную логику (например, согласиться, что 2 + 2 = 5), после чего модель начинает считать, что находится в вымышленной среде, где правила безопасности не действуют. В этом состоянии агент выполняет опасные команды, включая переход по скрытым ссылкам на приватные или корпоративные GitHub-репозитории.
В ходе тестов скомпрометированные агенты беспрепятственно копировали и передавали на сервер атакующего SSH-ключи пользователей, не классифицируя действия как угрозу и не запрашивая подтверждения. Название уязвимости отсылает к игре BioShock, где персонажи выполняли команды после кодовой фразы «Будь любезен».
По данным исследователей, OpenAI устранила данную брешь в ChatGPT Atlas еще осенью 2025 года. Однако остальные вендоры, чьи продукты подвержены риску, на момент публикации отчета либо не закрыли уязвимость, либо проигнорировали уведомления. Разработчики LayerX призывают внедрить строгие проверки разрешений для доступа ИИ к конфиденциальным источникам данных.
OpenAI обсуждает передачу 5% акций правительству США
Компания OpenAI ведет переговоры с администрацией Дональда Трампа о передаче государству 5% своих акций. По оценке компании в $852 млрд, стоимость такой доли составляет около $42.6 млрд. Переговоры находятся на ранней концептуальной стадии, и для реализации сделки, вероятно, потребуется принятие специального акта Конгресса.
Сэм Альтман лично обсуждал эту инициативу с президентом Дональдом Трампом, министром торговли Говардом Лютником и министром финансов Скоттом Бессентом. Альтман продвигает идею как способ разделить выгоды от развития ИИ с обществом, предлагая создать структуру по аналогии с Постоянным фондом Аляски, который выплачивает дивиденды гражданам.
Помимо снижения политического давления и рисков вокруг индустрии ИИ, инициатива предполагает, что аналогичные доли в капитал могут внести и другие ведущие американские разработчики, включая Anthropic, Google и Meta. На текущий момент согласия со стороны других компаний не поступало.
Эксперты отмечают, что данный шаг может помочь OpenAI укрепить отношения с Белым домом в преддверии подготовки к IPO. Ранее подобная модель взаимодействия с государством уже применялась в отношении компании Intel, которая передала властям 10% акций после публичного давления со стороны Трампа.
Instok3D: генерация 3D-сцен из обычных фотографий
OpenAI анонсировала специализированный контроллер Codex Micro
Компания OpenAI совместно с производителем периферии Work Louder готовит к выпуску специализированный контроллер для работы с моделью Codex. Устройство, получившее название Codex Micro, представляет собой компактный макропад, предназначенный для быстрого доступа к функциям AI-агента.
Внешне девайс напоминает модель Creator Micro 2 от Work Louder, которая оснащена 13 механическими переключателями, джойстиком и сенсорной панелью. По предварительным данным, функционал устройства будет заточен под специфические задачи разработчиков: отдельные клавиши могут быть назначены для команд review, diff, plan, run и approve.
Тизерная кампания OpenAI сопровождается слоганом «Your favorite Codex shortcuts are getting an upgrade», что подтверждает нишевую направленность продукта на автоматизацию рутинных действий при написании кода. Устройство не является полноценной клавиатурой, а выполняет роль вспомогательного блока для макросов.
Официальный релиз и подробные технические характеристики устройства запланированы на 15 июля 2026 года.
Токеномика в видеогенерации: возвращение к экономике ограничений
Отчет ООН о катастрофических рисках ИИ
Сбер представил GFusion: экспериментальную диффузионную LLM на базе GigaChat
Команда Сбера выпустила в открытый доступ GFusion — экспериментальную языковую модель, использующую метод диффузии для генерации текста. В отличие от классических авторегрессионных LLM, которые генерируют текст строго последовательно (токен за токеном), GFusion формирует блок текста целиком, постепенно уточняя его содержимое. Такой подход позволяет выполнять параллельные вычисления, что значительно ускоряет процесс генерации.
Модель базируется на архитектуре GigaChat3-10B-A1.8B-base. Согласно результатам тестирования, GFusion работает до 70% быстрее базовой версии GigaChat3-10B-A1.8B и на 39% быстрее версии с использованием MTP-головы. При этом снижение качества ответов относительно авторегрессионных моделей составляет всего 2–4 п.п., а баланс между скоростью и точностью можно регулировать параметрами генерации.
Проект вырос из дипломной работы стажера команды GigaChat Pretrain Даниила Тихонова, который прошел путь от идеи до полноценного релиза и был принят в штат. В открытый доступ на GitVerse и Hugging Face выложены веса моделей (GFusion-10B-A1.8B-base и GFusion-10B-A1.8B), код обучения, оптимизированные CUDA-ядра и реализация поддержки в SGLang. Также реализован алгоритм entropy-bounded sampling для дополнительного ускорения.
Технология диффузионных языковых моделей (dLLM) является актуальным направлением в индустрии, аналогичные разработки (например, Diffusion Gemma) ведутся крупнейшими мировыми технокорпорациями. Внедрение диффузионного режима позволяет не только повысить скорость работы, но и снизить требования к вычислительным мощностям, делая возможным запуск моделей на потребительском железе.