← к ленте

Сбер представил обновленную модель GigaChat Audio с распознаванием эмоций

Р@remediaгеймдев
1 мес

Сбер обновил GigaChat Audio: модель теперь распознает эмоции по голосу, обрабатывает аудио до 3 часов и различает спикеров. Также вышли модели GigaAM.

ГигаЧат научился понимать эмоции по голосу — Сбер представил обновлённую модель GigaChat Audio. Теперь ИИ анализирует не только слова, но и интонацию, тембр и особенности произношения, чтобы лучше понимать настроение собеседника и подбирать более уместные ответы. Также нейросеть умеет разбирать аудиозаписи длиной до трёх часов, искать нужные моменты, различать нескольких спикеров и готовить краткие пересказы разговоров. Модель уже лежит на Hugging Face. В релиз также вошло семейство моделей GigaAM для автоматического распознавания речи. Они поддерживают русский, английский, киргизский, казахский и узбекский языки и доступна в двух версиях — компактной, которая работает на обычных процессорах, и флагманской, обеспечивающей более высокое качество распознавания. Представлены на GitHub и Hugging Face. Обновления уже доступны разработчикам абсолютно бесплатно. А обычные пользователи могут попробовать живой формат общения в ИИ-помощнике ГигаЧат! 😳😳😳

Кратко (AI)

Сбер выпустил обновленную модель GigaChat Audio, которая научилась анализировать интонацию и тембр голоса для более точного понимания контекста. Новая версия поддерживает обработку длинных аудиозаписей, разделение спикеров и автоматическое создание пересказов. Также представлено семейство моделей GigaAM для распознавания речи на пяти языках.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖