ИИ

Алиса AI научилась распознавать рукописный текст, даже когда буквы слились в закорючки

Яндекс представил обновление голосового помощника Алиса AIi: теперь он умеет распознавать рукописный текст с фотографий — от студенческих конспектов до врачебных рецептов. Возможность появилась благодаря новой VLM-модели (vision-language model, модель, объединяющая распознавание изображений и текста).

Чтобы продемонстрировать возможности технологии, в Москве появились плакаты, на которых буквы «И», «ш», «л» и «м» написаны физически одинаково и слипаются в сплошную волну — различить их человеку можно только по смыслу фразы. Алиса AI при этом выдаёт с фото корректно распознанный текст даже на такой слитной скорописи.

Полный разбор →

Google выпустила продакшен-версию видеомодели Gemini Omni 1.1 Flash

Google представила Gemini Omni 1.1 Flash — обновленную мультимодальную модель для генерации и редактирования видео, которая перешла из стадии предварительного просмотра в полноценный продакшен-релиз. Инструмент получил расширенные возможности управления контентом, включая функции монтажа и оптимизированные режимы рендеринга.

Обновление ориентировано на профессиональное использование: модель позволяет создавать более длинные и детализированные видеоролики с улучшенным контролем над ключевыми кадрами. Доступ к функционалу открыт через Google AI Studio для разработчиков и платформу Google Flowi для пользователей.

40 секундмаксимальная длительность видео
60%ускорение генерации черновиков
$0,10стоимость секунды видео в 720p

Полный разбор →

Подборка инструментов и ресурсов для MiniMax-H3

Н@GreenNeuralRobotsAI-инженер
23 ч
Подборка инструментов и ресурсов для MiniMax-H3

Выпуск подкаста «на Вайбе»: обзор новостей ИИ

А@itbeardавтор про «it»
вчера

VK перешли на нейросетевой ранкер ленты рекомендаций

D@data_secretsAI-инженер
вчера
VK перешли на нейросетевой ранкер ленты рекомендаций

TIME опубликовал ежегодный список Time 100 AI

D@data_secretsAI-инженер
вчера
TIME опубликовал ежегодный список Time 100 AI из ста самых влиятельных людей в отрасли В отличие от прошлого года Илью Суцкевера и Демиса Хассабиса все-таки добавили, а вот Дженсен Хуанг вылетел 🤔 Андрея Карпаты тоже нет, зато в списке оказалась Перис Хилтон как активистка против распространения дипфейков. https://time.com/collection/time100-ai/2026/
TIME опубликовал ежегодный список Time 100 AI

Anthropic, OpenAI, Google, Microsoft и десятки других компаний предупредили о волне ИИ-кибератак

OpenAI опубликовала открытое письмо, призывающее государства и бизнес срочно готовиться к массовым кибератакам с использованием ИИ. Под письмом подписались Anthropic, Google, Microsoft, AWS, Cloudflare, Visa, Mastercard, CrowdStrike и более сотни других компаний — фактически «половина интернета».

Суть предупреждения: в ближайшие месяцы ИИ резко упростит проведение сложных кибератак, снизив порог входа для хакеров и позволив автоматизировать всё более изощрённые схемы. Текущий уровень киберзащиты у многих организаций, особенно в критической инфраструктуре, для этого не готов, а скоординированного ответа от государств, лабораторий и кибербезопасников пока нет.

более 100компаний-подписантов открытого письма

Полный разбор →

Релиз модели генерации изображений Fibo 1.5 от Bria AI

Н@GreenNeuralRobotsAI-инженер
вчера
Fibo 1.5 (Bria AI) Дистиллированная версия картинкогенератора FIBO 4-6 шагов вместо 50, без CFG, с улучшенным реализмом и текстурами. Дистилляция DMD + DMD-R поверх оригинального FIBO. При этом сохраняет JSON-native структурированный промптинг Fibo-Edit-1.5-base - редактирующая с мультиреференсом Есть турбоверсия HF - полный зоопарк ИИ-скилл #imageediting #json2image #skill VK | MAX
Релиз модели генерации изображений Fibo 1.5 от Bria AI

Тест самообучаемой модели Ornith 1.5 9B

Г@gmorevaAI-инженер
вчера
Видео про Ornith 1.5 9B Меня давно просили протестировать Ornith. Вот вышла версия 1.5 от DeepReinforce, которую называют «самообучаемой»: при RL-обучении модель сама генерирует себе задачи, скаффолды и роллауты, без фиксированных человеческих датасетов. Разбираюсь, что это значит на практике, и гоняю плотную 9B-версию в реальных задачах. Спойлер: я не ожидал такого от 9 миллиардов параметров. Ссылки на видео на всех площадках: 📹 YouTube | VK | Rutube | Dzen 📹

Почему делегирование текстов ИИ вредит мышлению: мнение Брета Стивенса

Т@yumaksавтор про «marketing»
вчера
Почему делегирование текстов ИИ вредит мышлению: мнение Брета Стивенса

Обзор венчурных сделок в ИИ-стартапы за 16-22 августа

С@ask_vcавтор про «startups»
вчера
Обзор венчурных сделок в ИИ-стартапы за 16-22 августа

Runway продлили действие плана Unlimited до конца 2026 года

Н@neuronutsAI-инженер
вчера
Runway продлили план Unlimited to 30 ноября 2026 года. Это касается только старых пользователей, у которых была такая подписка. Так что радуйтесь. После 30го ноября вас автоматически переведут на план Max. Если у вас была годовая подписка, можно будет отказаться от нее и получить refund за неиспользованный период.

DiffusionOPSD: новый метод дистилляции от Bytedance

Н@GreenNeuralRobotsAI-инженер
вчера
DiffusionOPSD Новый метод дистилляции от Bytedance для дообучения диффузионных моделей на их же собственных генерациях: цель для каждого шага обновляется постоянно, под текущее поведение модели, а не задаётся один раз заранее • собирает запросы прямо из генераций текущей модели • строит цели с положительным и отрицательным сдвигом внутри контролируемого радиуса • обновляет поведенческую модель скользящим средним без остановки цикла обучения Выложили LoRA для Z-Image-Turbo и SD3.5-M HF Github #training #optimization VK | MAX
DiffusionOPSD: новый метод дистилляции от Bytedance
Ещё ↓