Релиз Audio8 TTS Preview 0.1B



Компания Pika представила линейку аудиомоделей — Pika Music, Pika Soundtrack, Pika SFX и Pika Speech. Флагман линейки, Pika Music, — полноценный генератор песен по типу Suno и MiniMax Music: на вход можно подать текстовый промпт, готовый текст песни, референс голоса, музыкальный референс или всё это одновременно, на выходе — законченный трек длиной до 6 минут.
Запуск связан с усилением конкуренции на рынке генерации музыки: по замечанию источника, «Минимакс покусал Пику», после чего компания выпустила собственное аудио-семейство. Главный козырь Pika Music — цена: она заявлена как до 10 раз дешевле «сопоставимых» музыкальных моделей, что может заметно изменить экономику AI-генерации музыки для контент-мейкеров.
ByteDance Seed представила Seed Audio 1.0 — аудиомодель, которая по одному промпту генерирует целую звуковую сцену: речь, атмосферу и звуковые эффекты одновременно. Доступ к модели открыт через платформу BytePlusi.
Модель ориентирована на озвучку, подкасты и дубляж: она позволяет жёстко задавать тайминг репликi с точностью до 100 мс и создавать голоса как по текстовому описанию, так и по аудио- или визуальному референсу.
Это всё на сейчас.