← к ленте

PixVerse представила 30-секундный ролик, созданный с помощью Seedance 2.5

N@v_neuroAI-инженер
2 нед

PixVerse показала 30-секундный ролик, созданный моделью Seedance 2.5 от ByteDance, с использованием до 50 референсов для стабильности лиц.

Нейросети научились создавать длинные и связные видео без склеек, сохраняя персонажей в кадре.

  • Технология позволяет генерировать 30-секундные сцены одним проходом, что обеспечивает единство освещения и пространства.
  • Использование до 50 референсов решает проблему «плавающих» лиц, характерную для ранних моделей видеогенерации.
  • Интегрированный липсинк позволяет синхронизировать мимику с речью прямо в процессе генерации видео.
✴️ Батый идёт на Русь - и всё это сгенерировано PixVerse выложила 30-секундный ролик: зимняя долина, пар изо рта, сомкнутые щиты и короткое «Господи, помилуй» перед битвой. ✧ Чем сделано: Seedance 2.5 от ByteDance, в полный доступ модель вышла 31 июля. ✧ Почему без склеек: Тридцать секунд идут одним проходом, а не собираются из четырёхсекундных кусков, отсюда единый свет и одна долина. ✧ Откуда лица: До 50 референсов на вход, поэтому воины не меняются между планами. ✧ Звук сразу: Липсинк генерируется вместе с картинкой. ✧ Где косяки: Русская речь звучит так, будто её читает иностранец по транскрипции. Монгольские реплики вышли чуть естественнее. Сильнее всего сработало то, чего в ролике нет. Атаки не показали: всё обрывается за долю секунды до столкновения и держится на паузе и лицах. А вам русская речь в кадре ухо режет или уже терпимо? 😄

Кратко (AI)

PixVerse опубликовала 30-секундный видеоролик, полностью созданный нейросетью Seedance 2.5 от компании ByteDance. Модель позволяет генерировать длинные сцены без склеек и сохранять стабильность лиц благодаря использованию до 50 референсов, однако качество русской озвучки остается низким.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖