Релиз Qwen-Audio-3.0-TTS от Alibaba
Н@GreenNeuralRobotsAI-инженер
1 месAlibaba представила модель Qwen-Audio-3.0-TTS, занявшую первое место в рейтинге Artificial Analysis. Поддержка 16 языков, эмоций и API.
Qwen‑Audio‑3.0‑TTS
Говорилка от Alibaba
#1 на Artificial Analysis TTS Leaderboard
• 16 языков, русский есть, но мы знаем что у китайцев с ним туговато
• за один проход до 3 минут речи
• Flash-режим для реального времени
• Plus-режим для высококачественной генерации
• Управление через теги [whisper], [angry], [breaths], [laughs]
• Контроль через естественный язык. можно писать "читай как сказку"
• генерация голоса под разные акценты и эмоции
• поддержка мультиязычных промптов
• частота дискретизации 24 kHz
• задержка генерации ~1–2 сек на фразу
• совместимость с ComfyUI, vits, rvc-пайплайнами
в базе Qwen-LLM
Опенсорса, похоже, нет
API
#tts
Кратко (AI)
Компания Alibaba выпустила модель Qwen-Audio-3.0-TTS, которая возглавила рейтинг Artificial Analysis. Модель поддерживает 16 языков, управление эмоциями через теги и естественный язык, а также предлагает режимы Flash и Plus для разных задач.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖