← к ленте

MiniMax H3 Max: ускоренная версия модели от fal.ai

М@cgeventAI-инженер
вчера

Обзор MiniMax H3 Max — оптимизированной версии видеомодели от fal.ai с генерацией быстрее реального времени и улучшенным качеством.

Появление сверхбыстрых видеомоделей делает создание качественного видеоконтента доступным в реальном времени.

  • Генерация видео теперь происходит быстрее реального времени, что критично для интерактивных приложений.
  • Оптимизация inference-стека позволяет повысить производительность без потери визуального качества.
  • Разработчики получают инструмент, который значительно сокращает время ожидания при создании анимации и видео.
Минимакс на Максималках Речь за MiniMax H3 Max: post-trained версию H3 от Fal.ai, специально дообученную и оптимизированную под inference-стек fal. Главная дичь здесь - скорость. Fal показывают генерацию 15-секундного видео за примерно 3.5-15 секунд,то есть быстрее реального времени. При этом они отдельно утверждают, что это не трюк с кэшем, агрессивной квантизацией или sparse attention и что сохраняется нативное аудио и нативное разрешение. База при этом та же - MiniMax H3. И это не H3 Turbo из какого-нибудь стороннего workflow, а их собственный post-training fal + их оптимизированный inference. Они прямо пишут: “Try an early preview of our post trained version of H3.” Судя по примерам, он очень хорош в моушен, иллюстрацию, анимацию. И мне дико нравится все, что происходит вокруг Минимакса. Это прям времена – Stable Diffusion 1.5 – все чего-то тренируют, оптимизируют, выпускают. Копаем дальше(для упоротых)   Они добавили свои данные и специально дообучали модель на prompt adherence и визуальное качество Скорость реально безумная: около 3 секунд на 5 секунд видео. fal заявляет примерно 35x throughput относительно официального H3 endpoint. fal утверждает, что ускорение получено не за счет агрессивной квантизации/ухудшения качества, а за счет совместной оптимизации самой модели и собственного inference engine. 480p и 768p, 24 fps, ролики 5-15 секунд, нативный stereo audio. Важный нюанс: обычный H3 на fal умеет 2K, а у H3 Max сейчас заявлен максимум 768p Сейчас доступны text-to-video и image-to-video. Веса H3 Max – какитаки веса?!. На вопрос о релизе fal ответили: “We’ll release it soon!” Но пока неясно, означает ли это именно веса или полноценный публичный релиз endpoint/инструментария. Сам MiniMax ранее говорил, что официальный H3 уже CFG-distilled, а более экстремальные 4/8-NFE версии только исследуются. Поэтому H3 Max, похоже, отдельная ветка оптимизации fal, а не тот официальный distilled H3, о котором MiniMax говорил в AMA. И еще любопытное: fal утверждает, что в их собственном blind benchmark H3 Max занял #1 по overall quality, prompt understanding и aesthetics, обойдя все протестированные ими ведущие видеомодели. Верим? https://fal.ai/minimax-h3-max

Кратко (AI)

Компания fal.ai представила MiniMax H3 Max — дообученную версию видеомодели MiniMax H3, оптимизированную для работы на их собственном стеке. Модель демонстрирует высокую скорость генерации (быстрее реального времени) без использования агрессивной квантизации, сохраняя при этом высокое качество движения и следование промптам.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖