Обзор Sable: скрытый шедевр с выдающимся левел-дизайном


Сбер открыл в открытом доступе новую линейку GigaEmbeddings — моделей, которые переводят текст в числовые векторы для семантического поиска, RAGi-систем, классификации и кластеризации. Линейка состоит из трёх моделей — 480M, 3B и 10B-A1.8Bi — и распространяется бесплатно под лицензией MIT на HuggingFace и GitVerse.
Качество таких эмбеддингов напрямую влияет на точность ответов ИИ-ассистентов и снижает риск галлюцинаций, что критично в поддержке клиентов, работе с юридическими и финансовыми документами и внутренними базами знаний. Новое поколение стало заметно быстрее и сильнее в английском языке и коде, при этом не потеряв качество на русском.






Яндекс представил обновление голосового помощника Алиса AIi: теперь он умеет распознавать рукописный текст с фотографий — от студенческих конспектов до врачебных рецептов. Возможность появилась благодаря новой VLM-модели (vision-language model, модель, объединяющая распознавание изображений и текста).
Чтобы продемонстрировать возможности технологии, в Москве появились плакаты, на которых буквы «И», «ш», «л» и «м» написаны физически одинаково и слипаются в сплошную волну — различить их человеку можно только по смыслу фразы. Алиса AI при этом выдаёт с фото корректно распознанный текст даже на такой слитной скорописи.



Google представила Gemini Omni 1.1 Flash — обновленную мультимодальную модель для генерации и редактирования видео, которая перешла из стадии предварительного просмотра в полноценный продакшен-релиз. Инструмент получил расширенные возможности управления контентом, включая функции монтажа и оптимизированные режимы рендеринга.
Обновление ориентировано на профессиональное использование: модель позволяет создавать более длинные и детализированные видеоролики с улучшенным контролем над ключевыми кадрами. Доступ к функционалу открыт через Google AI Studio для разработчиков и платформу Google Flowi для пользователей.
