speech-to-speechСбросить фильтр ×

NVIDIA представила Audex: мультимодальную MoE-модель для работы со звуком

Н@GreenNeuralRobotsAI-инженер
1 мес
Audex Унифицированная аудио-текстовая MoE-модель от NVIDIA для работы со звуком, речью и рассуждениями без потери текстовой интеллектуальности • генерация речи и аудио • распознавание речи, перевод, прочее speech-to-speech • обработка речи и звуковых событий 30B параметров, 3B активных. Контекст до 1 млн токенов Есть версия на 2B #alm #speech2speech #tts #asr #text2audio #translation

Это всё на сейчас.