NVIDIA представила Audex: мультимодальную MoE-модель для работы со звуком
Н@GreenNeuralRobotsAI-инженер
1 месNVIDIA анонсировала Audex — унифицированную MoE-модель для генерации, распознавания и обработки аудио с поддержкой контекста до 1 млн токенов.
Audex
Унифицированная аудио-текстовая MoE-модель от NVIDIA для работы со звуком, речью и рассуждениями без потери текстовой интеллектуальности
• генерация речи и аудио
• распознавание речи, перевод, прочее speech-to-speech
• обработка речи и звуковых событий
30B параметров, 3B активных. Контекст до 1 млн токенов
Есть версия на 2B
#alm #speech2speech #tts #asr #text2audio #translation
Кратко (AI)
Компания NVIDIA представила Audex — унифицированную MoE-модель, предназначенную для комплексной работы со звуком, речью и текстовыми рассуждениями. Модель поддерживает генерацию аудио, распознавание речи и перевод, обладая контекстным окном до 1 млн токенов.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖