videogeneraciiaСбросить фильтр ×

МикроТриллер «Эмма»: эксперимент с нейросетевым видео

М@cgeventAI-инженер
12 ч

MiniMax H3 Max: fal.ai выпустили ускоренную версию видеомодели H3, обещают открыть веса

Fal.ai показали H3 Max — пост-трейн версию открытой модели MiniMax H3, специально дообученную и оптимизированную под собственный inference-стек fal. Модель генерирует видео быстрее реального времени: 5 секунд ролика за примерно 3 секунды генерации, что fal оценивает как ~35x по throughput относительно официального эндпоинта H3. Модель вышла на первое место в рейтинге Artificial Analysisi среди image-to-video (с аудио) моделей, обогнав Seedance 2.0, оригинальный H3 и старый Gemini Omni Flash.

Главная новость для сообщества — fal подтвердили планы открыть веса H3 Max, а на вопрос про открытие Ref2Vi-версии ответили «yes, working on it». Если это подтвердится, речь идёт о полноценном открытом чекпоинте, а не просто об API.

35x/36xускорение throughput относительно официального H3
$0.04цена за секунду видео первую неделю
768pтекущее максимальное разрешение H3 Max

Полный разбор →

SMACK — новая LoRA для MiniMax H3 добавляет «вес» ударам в экшен-сценах

Вышла LoRAi под названием SMACK (версия Beta 1) для видео-модели MiniMax H3 Ref2Vi, которая делает драки, столкновения и стрельбу в генерируемых роликах более физически убедительными. По словам автора, базовая модель H3 отрабатывает удары «слишком вежливо» — тела почти не реагируют на попадания, — а SMACK добавляет реальную реакцию на кулаки, оружие, автомобильные столкновения и падения, плюс более агрессивную работу камеры, похожую на съёмку каскадёрской команды, а не видео с телефона.

LoRA обучена всего на 35 клипах и не требует триггер-слова: достаточно подключить её к MiniMax H3 Ref2V, описать нужную сцену и запустить. Это заготовка для тех, кому не подошла предыдущая похожая LoRA от Omni 1.1.

35клипов в обучающем датасете LoRA
1.0рекомендуемая сила применения LoRA
0.8+сила при стекинге с другими LoRA

Полный разбор →

Подборка инструментов и ресурсов для MiniMax-H3

Н@GreenNeuralRobotsAI-инженер
20 ч
Подборка инструментов и ресурсов для MiniMax-H3

Runway продлили действие плана Unlimited до конца 2026 года

Н@neuronutsAI-инженер
23 ч
Runway продлили план Unlimited to 30 ноября 2026 года. Это касается только старых пользователей, у которых была такая подписка. Так что радуйтесь. После 30го ноября вас автоматически переведут на план Max. Если у вас была годовая подписка, можно будет отказаться от нее и получить refund за неиспользованный период.

Подборка инструментов и обновлений для MiniMax H3

Н@GreenNeuralRobotsAI-инженер
вчера

Подборка инструментов и воркфлоу для Minimax H3

Н@GreenNeuralRobotsAI-инженер
2 дн

Выход модели Wan 3.0 Prime с ускоренной генерацией видео

М@cgeventAI-инженер
3 дн

Создание фолк-мокьюментари «Баба Яга» с помощью нейросетей

М@cgeventAI-инженер
4 дн

4DAnyone: 4D-модель человека по видео с одной камеры

Исследователи из Zhejiang University, Robbyant, Ant Group и HKUST представили открытый фреймворк 4DAnyone, который строит объёмную 4D-модель движущегося человека по обычному видео с одной камеры — без рига, калибровки и штатива. Раньше для такой реконструкции требовалась студия с десятками синхронных камер.

Фреймворк генерирует 16 согласованных между собой ракурсов, которых камера не снимала, и собирает их в сцену формата 4D Gaussian Splattingi — объёмное представление, меняющееся во времени. Готовую модель можно осматривать с любой точки в VR, вставлять в игры, AR-сцены или использовать как обучающие данные для роботов.

16сгенерированных согласованных ракурсов
24.15 PSNRкачество реконструкции на DNA-Rendering
40ключевых точек скелета

Полный разбор →

MiniMax запустила десктопное приложение MiniMax Design — ИИ-агента полного цикла для видеопроизводства

MiniMax выпустила MiniMax Designi — десктопное приложение для Windows и macOS, где главный ИИ-агент сам разбивает творческую задачу на этапы и распределяет её между вспомогательными агентами: пишут сценарий, собирают раскадровку, генерируют изображения, видео и звук, монтируют ролик, накладывают озвучку и субтитры. На выходе пользователь получает готовое видео без необходимости самому переключаться между инструментами.

Продукт — развитие прежнего инструмента MiniMax Hub и построен вокруг новой модели H3i, которую компания встроила как основной движок генерации видео. Одновременно MiniMax ввела платную подписку с тарифами по объёму кредитов, то есть монетизировала линейку продуктов на базе H3.

10,5 долларастоимость тарифа Starter в месяц
215 долларовстоимость тарифа Pro в месяц
270 000 кредитовлимит на тарифе Pro

Полный разбор →

V-RAE: семантическое сжатие для видеогенераторов

Н@GreenNeuralRobotsAI-инженер
5 дн

CMD: метод дистилляции для авторегрессивной генерации видео от NVIDIA

Н@GreenNeuralRobotsAI-инженер
1 нед

AVA-Encoder: система графов знаний для видеогенерации от Qwen

Н@GreenNeuralRobotsAI-инженер
1 нед
AVA-Encoder: система графов знаний для видеогенерации от Qwen

Qwen-Video-Edit: редактирование видео через адаптацию Image-Edit моделей

Проект Qwen-Video-Editi предлагает метод редактирования видео без использования специализированных видео-трансформеров. Вместо этого система адаптирует возможности модели Qwen-Image-Edit для работы с видеопотоком.

Технология преобразует кадры видео в латентное пространство с помощью VAEi от Wan 2.1, после чего они объединяются в «виртуальную сетку» и обрабатываются как единое изображение. Для обеспечения временной связности и качества итоговый результат проходит дополнительную обработку через модель Wan 2.2.

ВыводПроцесс обработки включает последовательность: видео → Wan VAE → Qwen-Image-Edit → Wan VAE → Wan 2.2 enhancement.

45 кадровразмер сегмента видео
360pразрешение обработки
80 ГБвес модели Wan 2.2 A14B

Полный разбор →

Sand.ai представила открытую видеомодель MAGI-2 Preview

э@ai_newzAI-инженер
1 нед

MiniMax H3 Extender: инструмент для генерации длинных видео

Н@GreenNeuralRobotsAI-инженер
1 нед
MiniMax H3 Extender: инструмент для генерации длинных видео
Ещё ↓