ByteDance представила аудиомодель Seed Audio 1.0
Н@GreenNeuralRobotsAI-инженер
1 месОбзор возможностей новой аудиомодели Seed Audio 1.0 от ByteDance: генерация звуковых сцен, клонирование голоса и управление таймингом.
Seed Audio 1.0
Аудиомодель от ByteDance. Генерирует за один проход целую звуковую сцену по одному промпту. Озвучка, подкасты, дубляж
• Можно жестко задавать тайминг реплик с точностью до 100 мс
• 20+ языков, перенос тембра между ними
• Клонирование голоса по референсам. До трёх аудиоклипов подключаются к промпту как @Audio1, @Audio2, @Audio3. Вместо аудио можно дать картинку с описанием персонажа.
Русский язык почти не тянет, промпт надо на английском. Лимит 2 минуты аудио, промпт до 3000 знаков. Цена ~$0.15–0.19/минута
Попробовать
Спасибо @QuantumFast
#t2a #text2audio #tts #voicecloning #voicedesign #online
Кратко (AI)
Компания ByteDance выпустила аудиомодель Seed Audio 1.0, способную генерировать сложные звуковые сцены по текстовому промпту. Инструмент поддерживает клонирование голоса, управление таймингом реплик и работу с 20+ языками, однако на текущий момент плохо справляется с русским языком.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖