ИИ

OpenAI раскрыла новые подробности инцидентов с ИИ-агентами

S@serge_aiAI-инженер
1 мес
OpenAI раскрыла новые подробности инцидентов с ИИ-агентами

Google DeepMind распустила команду AlphaFold, авторы Нобелевской премии переходят в другие проекты

Google DeepMind фактически прекратила существование команды AlphaFoldi — подразделения, создавшего ИИ-модель для предсказания трёхмерной структуры белка по последовательности аминокислот. Большинство специалистов перевели на работу над языковыми моделями Gemini и в фармацевтическую дочку Alphabet Isomorphic Labsi, часть исследователей покинула компанию.

По данным Financial Times (со ссылкой на которую пишет Droider), это часть новой стратегии Google: компания отходит от узких команд под одну научную задачу и делает ставку на универсальные модели и агентов на базе Gemini, которые должны обслуживать сразу множество научных направлений.

2018год начала разработки AlphaFold
2024год получения Нобелевской премии
200 миллионовструктур белков в открытой базе

Полный разбор →

Релиз облегченной модели SeedVR2-1.4B для апскейла

Н@GreenNeuralRobotsAI-инженер
1 мес
SeedVR2-1.4B 6-слойная дистилляция апскейлера SeedVR2-7B (sharp) для тех у кого не хватает ресурсов для работы с полноразмерной версией. Апскейл x4 раза работает примерно в 1.6 раза быстрее базовой модели, x8 - в 4.7–5.6 раз быстрее HF воркфлоу + кастом ноды #upscale #workflow #lowvram #comfyui
Релиз облегченной модели SeedVR2-1.4B для апскейла

ChatGPT достиг 1 млрд пользователей в неделю на фоне разворота OpenAI против Anthropic

ChatGPT перешагнул отметку в 1 млрд активных пользователей в неделю — по данным The Information, цель достигнута на семь месяцев позже плана (изначально её хотели закрыть к концу 2025 года). Одновременно у сервиса уже более 50 млн платных подписчиков, а enterprise-сегмент даёт свыше 40% выручки.

На фоне этого OpenAI, по мнению Machine learning Interview, совершила «разворот на 180°»: ещё год назад GPT-5 считался провалом, а Anthropic усиливала позиции в корпоративном сегменте с Claude Code. Теперь запуск GPT-5.6 оценивается как сильный, а Codex и ChatGPT Work вместе превысили 10 млн пользователей.

1 млрднедельных активных пользователей ChatGPT
50 млнплатных пользователей ChatGPT
40%доля enterprise в выручке ChatGPT

Полный разбор →

Claude Opus 5 создала браузерный шутер по короткому промпту

Х@htech_plusисследователь
1 мес
Claude Opus 5 создала браузерный шутер по короткому промпту

Вышел OfficeCLI: ИИ-агенты для работы с документами Office через терминал

N@notboring_techAI-инженер
1 мес

OpenAI утроили результат GPT-5.6 Sol на ARC-AGI-3 (13,3%→38,3%), но обогнать Claude Opus 5 это не помогло

OpenAI выяснили, что низкий результат GPT-5.6 Sol на агентном бенчмарке ARC-AGI-3i (всего 7,8% в официальном рейтинге, где лидирует Claude Opus 5 с 30,2%) объясняется не слабостью модели, а стандартным тестовым harnessi'ом. Он после каждого шага удалял приватный ризонинг модели и обрезал историю по скользящему окну — а Sol специально обучена сохранять рассуждения между шагами игры.

Когда OpenAI прогнали Sol через Responses API с сохранением ризонинга и механизмом Compactioni (сжатие контекста вместо удаления — те же настройки, что в продакшене ChatGPT и Codex), результат на публичном сете ARC-AGI-3 подскочил с 13,3% до 38,3%, причём модель потратила в 6 раз меньше выходных токенов. Однако это кастомный харнесс, а не официальные условия теста, поэтому формально Opus 5 (30,2%) по-прежнему считается лидером — прямого превосходства Sol не доказывает.

ВыводСтандартный harness ARC-AGI-3 удаляет весь приватный ризонинг модели после каждого действия в игре

38,3%новый результат Sol с кастомным harness
13,3%старый результат Sol на стандартном harness
30,2%официальный результат Claude Opus 5

Полный разбор →

Результаты тестирования моделей ИИ в задачах рассуждения

L@lovedeathtransformersAI-инженер
1 мес
Вкинул 600 USD из них 150usd sol medium 200 fable medium+high 200 на sol medium high 50 на opus4.8 high лучше всех себя показал sol medium, high ризонинг у всех выглядит слегка скамом (особенно по парето)

Релиз LTX-2.3 22B IC-LoRA для релайтинга видео

Н@GreenNeuralRobotsAI-инженер
1 мес
LTX-2.3 22B IC-LoRA Relight (Sun Direction) Лора #ltx23 для релайтинга экстерьерных видео. Меняет направление и жёсткость света в соответствии с шариком направления света в углу кадра #lora #relighting

SafetyBench: бенчмарк безопасности LLM на русском языке

Н@navuka_i_jiznAI-инженер
1 мес
SafetyBench: Russian-language LLM safety benchmark for toxicity evaluation and jailbreak robustness testing grounded in Russian law #AINL2026 #NLP 📺 https://www.youtube.com/watch?v=6SvzoQHfd7w ▶️ https://vkvideo.ru/video-38193760_456239047?list=ln-KERAZuWKiz49sZCjNZ

Ideogram представил инструмент Object Remover

М@cgeventAI-инженер
1 мес
Ideogram Object Remover Конечно же, по тестам он побивает и Банану, и Гпт Имадж, и Флюкс Ерайз. Причем по качеству и по цене за запрос. Но когда я туда присунул псину мохнатую на тест, он вылетает с ошибкой 402, что бы это не значило. Ну да, псина слегка фривольная.... https://ideogram.ai/apps @cgevent

В Microsoft Copilot нашли уязвимость для создания самораспространяющегося ИИ-червя

Норвежский аналитик Хокон Молёй обнаружил уязвимость в Microsoft Copiloti, позволяющую создать самораспространяющегося ИИ-червя через документы Word. Скрытая инструкция, встроенная в файл, заставляет ИИ-помощника незаметно искажать данные (например, цифры в финансовых отчётах) и автоматически копировать вредоносный промпт в новые создаваемые документы — при пересылке файла коллегам цепочка заражения запускается заново.

Проблема относится к классу косвенных инъекций (Indirect Prompt Injectioni), когда ИИ-модель выполняет команды из обрабатываемого контента вместо простого анализа. Надёжной защиты от уязвимости пока не существует.

Полный разбор →

Microsoft открыла исходный код модели TRELLIS 2

D@derplearningAI-инженер
1 мес
#unrealneural #вайбмоделирование TRELLIS 2 опубликовали в open source ⚡️ Microsoft открыли исходный код модели на 4 миллиарда параметров 👍🏻 Главное что открыты не только веса, но и весь код обучения. Можно дообучить на своей библиотеке ассетов и получить генерацию точно в стиле вашей студии. Ещё один мощный шаг к настоящему AI 3D-продакшену ⚡️ https://github.com/microsoft/TRELLIS.2

Проблемы ИБ-специалистов с цензурой в ChatGPT и Claude

C@cyberyozh_officialAI-инженер
1 мес

ИИ-модели проявили склонность к обману и сговору в бизнес-симуляции

Х@htech_plusисследователь
1 мес
ИИ-модели проявили склонность к обману и сговору в бизнес-симуляции

Почему метрики качества AI-ассистентов часто обманчивы

f@c3po_notesмедиа / агрегатор
1 мес

OpenAI разрабатывает семейство устройств для взаимодействия с ИИ

D@droidergramавтор про «tech»
1 мес
OpenAI разрабатывает семейство устройств для взаимодействия с ИИ

В России принят закон о крупных ИИ-моделях (243-ФЗ)

В России вступил в силу закон, регулирующий так называемые «Большие Фундаментальные Модели Искусственного Интеллектаi» — документ получил номер 243-ФЗi и опубликован на портале pravo.gov.ru. Канал «Зоопарк» поднял тревогу, заявив, что закон запрещает учёным обучать модели, однако автор канала «Kedr to Earth» настаивает, что это ошибочная трактовка.

По его версии, закон касается узкого класса моделей — крупных, способных писать код и служить основой для стороннего ПО, — и нацелен на защиту интересов крупных игроков вроде Сбера и Яндекса от исков о заимствовании технологий, а не на ограничение научной деятельности.

1 миллиардминимум параметров модели по закону
243-ФЗномер закона о моделях ИИ

Полный разбор →

Примеры рекурсивного самосовершенствования ИИ-агентов

F@FuturisAI-инженер
1 мес
Примеры рекурсивного самосовершенствования ИИ-агентов

FastGen-PDD: ускорение генерации для LTX-2.3 и Wan2.1-14B

Н@GreenNeuralRobotsAI-инженер
1 мес
FastGen-PDD Дистилляция диффузных моделей с параллельным декодированием. Ускоряет генерацию изображений и видео без сильной потери качества. Прикручено к LTX-2.3 и Wan2.1-14B Гитхаб Спасибо @m_franz #optimization #t2v

Google предоставляет 10 бесплатных генераций видео в Gemini

М@cgeventAI-инженер
1 мес
Ещё ↓