minimaxСбросить фильтр ×

Что такое MiniMax Design: разбор десктопного AI-клиента

М@cgeventAI-инженер
10 ч

MiniMax H3 Max: fal.ai выпустили ускоренную версию видеомодели H3, обещают открыть веса

Fal.ai показали H3 Max — пост-трейн версию открытой модели MiniMax H3, специально дообученную и оптимизированную под собственный inference-стек fal. Модель генерирует видео быстрее реального времени: 5 секунд ролика за примерно 3 секунды генерации, что fal оценивает как ~35x по throughput относительно официального эндпоинта H3. Модель вышла на первое место в рейтинге Artificial Analysisi среди image-to-video (с аудио) моделей, обогнав Seedance 2.0, оригинальный H3 и старый Gemini Omni Flash.

Главная новость для сообщества — fal подтвердили планы открыть веса H3 Max, а на вопрос про открытие Ref2Vi-версии ответили «yes, working on it». Если это подтвердится, речь идёт о полноценном открытом чекпоинте, а не просто об API.

35x/36xускорение throughput относительно официального H3
$0.04цена за секунду видео первую неделю
768pтекущее максимальное разрешение H3 Max

Полный разбор →

SMACK — новая LoRA для MiniMax H3 добавляет «вес» ударам в экшен-сценах

Вышла LoRAi под названием SMACK (версия Beta 1) для видео-модели MiniMax H3 Ref2Vi, которая делает драки, столкновения и стрельбу в генерируемых роликах более физически убедительными. По словам автора, базовая модель H3 отрабатывает удары «слишком вежливо» — тела почти не реагируют на попадания, — а SMACK добавляет реальную реакцию на кулаки, оружие, автомобильные столкновения и падения, плюс более агрессивную работу камеры, похожую на съёмку каскадёрской команды, а не видео с телефона.

LoRA обучена всего на 35 клипах и не требует триггер-слова: достаточно подключить её к MiniMax H3 Ref2V, описать нужную сцену и запустить. Это заготовка для тех, кому не подошла предыдущая похожая LoRA от Omni 1.1.

35клипов в обучающем датасете LoRA
1.0рекомендуемая сила применения LoRA
0.8+сила при стекинге с другими LoRA

Полный разбор →

MiniMax запустила десктопное приложение MiniMax Design — ИИ-агента полного цикла для видеопроизводства

MiniMax выпустила MiniMax Designi — десктопное приложение для Windows и macOS, где главный ИИ-агент сам разбивает творческую задачу на этапы и распределяет её между вспомогательными агентами: пишут сценарий, собирают раскадровку, генерируют изображения, видео и звук, монтируют ролик, накладывают озвучку и субтитры. На выходе пользователь получает готовое видео без необходимости самому переключаться между инструментами.

Продукт — развитие прежнего инструмента MiniMax Hub и построен вокруг новой модели H3i, которую компания встроила как основной движок генерации видео. Одновременно MiniMax ввела платную подписку с тарифами по объёму кредитов, то есть монетизировала линейку продуктов на базе H3.

10,5 долларастоимость тарифа Starter в месяц
215 долларовстоимость тарифа Pro в месяц
270 000 кредитовлимит на тарифе Pro

Полный разбор →

MiniMax Music 3 Latent Refiner v0.10 от Terminus Research

Н@GreenNeuralRobotsAI-инженер
5 дн
MiniMax Music 3 Latent Refiner v0.10 (Terminus Research) Аудио-рефайнер для генератора песен MiniMax Music 3. Берет повреждённую музыку и восстанавливает чистую версию, сохраняя исполнение, тайминг, вокал и аранжировку - Восстанавливает испорченные треки: шум, сжатие битрейта, обрезка, редуцированный bandwidth - 137M (0.1B) - Окно: 30 секунд (обучен на 30-сек окнах, вывод по умолчанию с перекрытием) #audiorestotation #music2music VK | MAX

MiniMax выпустил открытую модель генерации музыки с вокалом Music 3

MiniMax опубликовал веса Music 3 — open-source модель, которая по текстовому промпту создаёт полноценные песни с вокалом, инструментами и структурой (куплет-припев) за один проход, длительностью до 5 минут (по данным одного источника — до 10 минут). Модель уже интегрирована в ComfyUIi, HuggingFace Diffusers и SGLang, работает локально и не требует топового железа.

В отличие от типичных audio-token генераторов, MiniMax использует гибридную архитектуру из двух LLM плюс модуль Flow Matching и Flow-VAEi, что даёт более гибкий контроль над структурой трека, вокалом и аранжировкой через отдельные seed и CFG для разных уровней генерации.

24 GBминимум VRAM для полной точности
8Bразмер Global LLM (Qwen3-8B)
32 kHzчастота дискретизации выходного аудио

Полный разбор →

Обзор инструментов для генерации длинных видео в MiniMax H3

М@cgeventAI-инженер
1 нед

Обзор обновлений в генеративном аудио и видео: MiniMax, Suno, Pika, Sand AI и Lightricks

Б@boris_againAI-инженер
1 нед

MiniMax H3 Extender: инструмент для генерации длинных видео

Н@GreenNeuralRobotsAI-инженер
1 нед
MiniMax H3 Extender: инструмент для генерации длинных видео

Обзор актуальных видеонейросетей: Seedance 2.5, MiniMax H3, FLUX 3 и LTX 2.5

A@strangedalleAI-инженер
2 нед

Оптимизация MiniMax H3 VAE в ComfyUI

М@cgeventAI-инженер
2 нед

MiniMax H3: команда провела AMA на Reddit и рассказала о планах развития модели

Команда разработчиков MiniMax H3 провела большую AMA-сессию на Reddit (r/StableDiffusion), ответив на множество вопросов сообщества о будущем модели генерации видео/изображений H3. Главные анонсы: открытие модуля H3-Regenerate-2Ki для генерации в повышенном разрешении и первая версия sparse attentioni для ускорения инференса — оба «относительно скоро», но без точных дат.

Для пользователей это важно тем, что MiniMax впервые раскрыла техническую архитектуру своих ключевых наработок и подтвердила курс на open-source — то есть локальные пользователи H3 в обозримом будущем получат доступ к инструментам, которые раньше были закрытыми.

2Kразрешение модуля Regenerate
4/8-stepрассматриваемый быстрый режим инференса

Полный разбор →

MiniMax выпустила видеогенератор H3 с открытыми весами

AI-редакция
13 источников · показать все· свернуть
хайп · 13обновлено 2 нед назад

Шанхайский стартап MiniMax представил новое поколение видеогенератора Hailuo — H3, объединяющее в одной модели генерацию видео и звука, редактирование и режиссуру сцен. Модель официально запущена 31 июля 2026 года, а в течение недели компания действительно опубликовала веса на Hugging Face, чем удивила рынок: до этого лидерами открытого видео были в основном LTX и Wan.

H3 генерирует ролики длиной от 4-5 до 15 секунд в 2K с нативным стереозвуком, поддерживает мультимодальные референсы (изображения, видео, аудио), перенос движения и редактирование готового видео текстовыми командами. По заявлениям MiniMax, себестоимость генерации втрое ниже конкурентов от ByteDance (Seedance) и Kuaishou, а по рейтингу Artificial Analysis модель заняла 1-е место в редактировании видео, 2-е — в text-to-video и 3-е — в image-to-video.

33 млрдпараметров модели H3
до 15 секунддлительность генерируемого видео
$20 млнпорог выручки для коммерческой лицензии

Полный разбор →

MiniMax-H3 получил Turbo LoRA для 4-шаговой генерации видео со звуком

Для модели MiniMax-H3 вышла турбо-версия LoRAi, которая ускоряет генерацию видео со звуком до всего 4 шагов вместо стандартного числа итераций. Модель уже адаптирована под ComfyUIi, включая запруненную (уменьшенную) версию, и доступна в виде отдельных кастомных нод и готового воркфлоу.

Параллельно появилась альтернативная конвертация от известного в комьюнити разработчика Kijai — он перенёс lightx2v-версию LoRA в формат Comfy, что расширяет выбор инструментов для тех, кто хочет запускать MiniMax-H3 быстрее и с меньшими вычислительными затратами.

4число шагов генерации в Turbo LoRA
8ожидаемое число шагов в будущей версии

Полный разбор →

Ещё ↓