← к ленте

Google представила модель Gemini 3.5 Transcribe

P@pppromptAI-инженер
вчера

Google выпустила Gemini 3.5 Transcribe — новую модель для распознавания речи с поддержкой 85+ языков, включая русский.

Новая модель от Google упрощает автоматическую расшифровку аудио, делая текст более чистым и готовым к использованию.

  • Модель автоматически удаляет слова-паразиты и учитывает исправления говорящего в реальном времени.
  • Улучшенная работа с фоновым шумом и различными акцентами повышает точность транскрипции.
  • Поддержка более 85 языков делает инструмент доступным для широкого круга задач, включая работу с русским языком.
  • Разработчики могут интегрировать модель в свои продукты через Gemini API.
Google выпустили Gemini 3.5 Transcribe, новую модель для перевода речи в текст. Она не просто дословно расшифровывает аудио, а лучше понимает живую речь: распознаёт исправления на ходу, убирает слова-паразиты, форматирует текст и лучше работает с шумом, акцентами и диалектами. Модель поддерживает 85+ языков, включая русский, и уже доступна разработчикам в Gemini API и AI Studio. https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5-transcribe/ @ppprompt

Кратко (AI)

Google анонсировала модель Gemini 3.5 Transcribe, предназначенную для перевода речи в текст. Инструмент отличается улучшенным пониманием живой речи, способностью фильтровать слова-паразиты и работать с акцентами, поддерживая более 85 языков.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖