PixVerse представила 30-секундный ролик, созданный с помощью Seedance 2.5
N@v_neuroAI-инженер
2 недPixVerse показала 30-секундный ролик, созданный моделью Seedance 2.5 от ByteDance, с использованием до 50 референсов для стабильности лиц.
Нейросети научились создавать длинные и связные видео без склеек, сохраняя персонажей в кадре.
- Технология позволяет генерировать 30-секундные сцены одним проходом, что обеспечивает единство освещения и пространства.
- Использование до 50 референсов решает проблему «плавающих» лиц, характерную для ранних моделей видеогенерации.
- Интегрированный липсинк позволяет синхронизировать мимику с речью прямо в процессе генерации видео.
✴️ Батый идёт на Русь - и всё это сгенерировано
PixVerse выложила 30-секундный ролик: зимняя долина, пар изо рта, сомкнутые щиты и короткое «Господи, помилуй» перед битвой.
✧ Чем сделано: Seedance 2.5 от ByteDance, в полный доступ модель вышла 31 июля.
✧ Почему без склеек: Тридцать секунд идут одним проходом, а не собираются из четырёхсекундных кусков, отсюда единый свет и одна долина.
✧ Откуда лица: До 50 референсов на вход, поэтому воины не меняются между планами.
✧ Звук сразу: Липсинк генерируется вместе с картинкой.
✧ Где косяки: Русская речь звучит так, будто её читает иностранец по транскрипции. Монгольские реплики вышли чуть естественнее.
Сильнее всего сработало то, чего в ролике нет. Атаки не показали: всё обрывается за долю секунды до столкновения и держится на паузе и лицах.
А вам русская речь в кадре ухо режет или уже терпимо? 😄
Кратко (AI)
PixVerse опубликовала 30-секундный видеоролик, полностью созданный нейросетью Seedance 2.5 от компании ByteDance. Модель позволяет генерировать длинные сцены без склеек и сохранять стабильность лиц благодаря использованию до 50 референсов, однако качество русской озвучки остается низким.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖