MiniMax H3 Max: ускоренная версия модели от fal.ai
М@cgeventAI-инженер
вчераОбзор MiniMax H3 Max — оптимизированной версии видеомодели от fal.ai с генерацией быстрее реального времени и улучшенным качеством.
Появление сверхбыстрых видеомоделей делает создание качественного видеоконтента доступным в реальном времени.
- Генерация видео теперь происходит быстрее реального времени, что критично для интерактивных приложений.
- Оптимизация inference-стека позволяет повысить производительность без потери визуального качества.
- Разработчики получают инструмент, который значительно сокращает время ожидания при создании анимации и видео.
Минимакс на Максималках
Речь за MiniMax H3 Max: post-trained версию H3 от Fal.ai, специально дообученную и оптимизированную под inference-стек fal.
Главная дичь здесь - скорость. Fal показывают генерацию 15-секундного видео за примерно 3.5-15 секунд,то есть быстрее реального времени. При этом они отдельно утверждают, что это не трюк с кэшем, агрессивной квантизацией или sparse attention и что сохраняется нативное аудио и нативное разрешение.
База при этом та же - MiniMax H3.
И это не H3 Turbo из какого-нибудь стороннего workflow, а их собственный post-training fal + их оптимизированный inference.
Они прямо пишут: “Try an early preview of our post trained version of H3.”
Судя по примерам, он очень хорош в моушен, иллюстрацию, анимацию.
И мне дико нравится все, что происходит вокруг Минимакса. Это прям времена – Stable Diffusion 1.5 – все чего-то тренируют, оптимизируют, выпускают.
Копаем дальше(для упоротых)
Они добавили свои данные и специально дообучали модель на prompt adherence и визуальное качество
Скорость реально безумная: около 3 секунд на 5 секунд видео. fal заявляет примерно 35x throughput относительно официального H3 endpoint.
fal утверждает, что ускорение получено не за счет агрессивной квантизации/ухудшения качества, а за счет совместной оптимизации самой модели и собственного inference engine.
480p и 768p, 24 fps, ролики 5-15 секунд, нативный stereo audio. Важный нюанс: обычный H3 на fal умеет 2K, а у H3 Max сейчас заявлен максимум 768p
Сейчас доступны text-to-video и image-to-video.
Веса H3 Max – какитаки веса?!. На вопрос о релизе fal ответили: “We’ll release it soon!” Но пока неясно, означает ли это именно веса или полноценный публичный релиз endpoint/инструментария.
Сам MiniMax ранее говорил, что официальный H3 уже CFG-distilled, а более экстремальные 4/8-NFE версии только исследуются. Поэтому H3 Max, похоже, отдельная ветка оптимизации fal, а не тот официальный distilled H3, о котором MiniMax говорил в AMA.
И еще любопытное: fal утверждает, что в их собственном blind benchmark H3 Max занял #1 по overall quality, prompt understanding и aesthetics, обойдя все протестированные ими ведущие видеомодели. Верим?
https://fal.ai/minimax-h3-max
Кратко (AI)
Компания fal.ai представила MiniMax H3 Max — дообученную версию видеомодели MiniMax H3, оптимизированную для работы на их собственном стеке. Модель демонстрирует высокую скорость генерации (быстрее реального времени) без использования агрессивной квантизации, сохраняя при этом высокое качество движения и следование промптам.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖