Релиз модели Qwen-Audio-3.0-ASR-Flash
Н@GreenNeuralRobotsAI-инженер
4 недAlibaba представила Qwen-Audio-3.0-ASR-Flash — новую коммерческую модель для распознавания речи с поддержкой пользовательских терминов.
Новая модель от Alibaba упрощает внедрение качественного распознавания речи в бизнес-приложения.
- Улучшенная точность распознавания узкоспециализированных терминов.
- Возможность настройки пользовательских словарей (горячих слов).
- Наличие специализированных версий для потоковой передачи и обработки файлов.
Qwen-Audio-3.0-ASR-Flash
Новая коммерческая модель для распознавания речи с улучшенной контекстной осведомленностью и распознаванием терминов в разных доменах
• Точное распознавание терминов в специфических областях
• Поддержка пользовательских горячих слов
Доступны версии:
Qwen-Audio-3.0-ASR-Flash-Streaming - потоковое распознавание речи
Qwen-Audio-3.0-ASR-Flash-Filetrans - распознавание записанной речи (HTTP API)
Qwen-Audio-3.0-ASR-Flash - не потоковое распознавание
#asr

Кратко (AI)
Alibaba выпустила новую коммерческую модель Qwen-Audio-3.0-ASR-Flash, предназначенную для распознавания речи. Модель отличается улучшенной контекстной осведомленностью и поддержкой пользовательских словарей для специфических доменов. Доступны три версии: для потоковой обработки, работы с файлами через HTTP API и стандартного распознавания.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖