Google представила модель Gemini 3.5 Transcribe
P@pppromptAI-инженер
вчераGoogle выпустила Gemini 3.5 Transcribe — новую модель для распознавания речи с поддержкой 85+ языков, включая русский.
Новая модель от Google упрощает автоматическую расшифровку аудио, делая текст более чистым и готовым к использованию.
- Модель автоматически удаляет слова-паразиты и учитывает исправления говорящего в реальном времени.
- Улучшенная работа с фоновым шумом и различными акцентами повышает точность транскрипции.
- Поддержка более 85 языков делает инструмент доступным для широкого круга задач, включая работу с русским языком.
- Разработчики могут интегрировать модель в свои продукты через Gemini API.
Google выпустили Gemini 3.5 Transcribe, новую модель для перевода речи в текст. Она не просто дословно расшифровывает аудио, а лучше понимает живую речь: распознаёт исправления на ходу, убирает слова-паразиты, форматирует текст и лучше работает с шумом, акцентами и диалектами.
Модель поддерживает 85+ языков, включая русский, и уже доступна разработчикам в Gemini API и AI Studio.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5-transcribe/
@ppprompt
Кратко (AI)
Google анонсировала модель Gemini 3.5 Transcribe, предназначенную для перевода речи в текст. Инструмент отличается улучшенным пониманием живой речи, способностью фильтровать слова-паразиты и работать с акцентами, поддерживая более 85 языков.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖