NVIDIA представила Audex: мультимодальную MoE-модель для работы со звуком
Н@GreenNeuralRobotsAI-инженер
1 месAudex
Унифицированная аудио-текстовая MoE-модель от NVIDIA для работы со звуком, речью и рассуждениями без потери текстовой интеллектуальности
• генерация речи и аудио
• распознавание речи, перевод, прочее speech-to-speech
• обработка речи и звуковых событий
30B параметров, 3B активных. Контекст до 1 млн токенов
Есть версия на 2B
#alm #speech2speech #tts #asr #text2audio #translation