videoСбросить фильтр ×

MiniMax H3 Max: fal.ai выпустили ускоренную версию видеомодели H3, обещают открыть веса

Fal.ai показали H3 Max — пост-трейн версию открытой модели MiniMax H3, специально дообученную и оптимизированную под собственный inference-стек fal. Модель генерирует видео быстрее реального времени: 5 секунд ролика за примерно 3 секунды генерации, что fal оценивает как ~35x по throughput относительно официального эндпоинта H3. Модель вышла на первое место в рейтинге Artificial Analysisi среди image-to-video (с аудио) моделей, обогнав Seedance 2.0, оригинальный H3 и старый Gemini Omni Flash.

Главная новость для сообщества — fal подтвердили планы открыть веса H3 Max, а на вопрос про открытие Ref2Vi-версии ответили «yes, working on it». Если это подтвердится, речь идёт о полноценном открытом чекпоинте, а не просто об API.

35x/36xускорение throughput относительно официального H3
$0.04цена за секунду видео первую неделю
768pтекущее максимальное разрешение H3 Max

Полный разбор →

Rockstar выложила исходный файл презентации GTA VI

B@biggeekавтор про «tech»
вчера
Rockstar выложила презентацию GTA VI в открытый доступ Если вы ещё не устали от новостей про GTA VI в каждом сообществе и на каждом канале, или вдруг пропустили ночной показ на Netflix и YouTube, то теперь вы можете скачать полную игровую презентацию с сайта Rockstar без ограничений. Видео на 14 гигабайт без сжатия и артефактов в максимальном качестве доступно по ссылке: https://www.rockstargames.com/VI/media/videos
Rockstar выложила исходный файл презентации GTA VI

Google выпустила продакшен-версию видеомодели Gemini Omni 1.1 Flash

Google представила Gemini Omni 1.1 Flash — обновленную мультимодальную модель для генерации и редактирования видео, которая перешла из стадии предварительного просмотра в полноценный продакшен-релиз. Инструмент получил расширенные возможности управления контентом, включая функции монтажа и оптимизированные режимы рендеринга.

Обновление ориентировано на профессиональное использование: модель позволяет создавать более длинные и детализированные видеоролики с улучшенным контролем над ключевыми кадрами. Доступ к функционалу открыт через Google AI Studio для разработчиков и платформу Google Flowi для пользователей.

40 секундмаксимальная длительность видео
60%ускорение генерации черновиков
$0,10стоимость секунды видео в 720p

Полный разбор →

Обновление ComfyUI-QwenVL: оптимизация работы с видео

Н@GreenNeuralRobotsAI-инженер
18 ч
ComfyUI-QwenVL запуск Qwen-VL внутри #ComfyUI - визуальное понимание и генерация текста. Раньше при попытке скормить видео 1080p нода вылетала с OOM, теперь автоматический рассчет токенов и масштабирование кадров под контекст модели - Умное масштабирование видео: 1080p/4K автоматически поджимается под безопасный бюджет токенов — 16-32 кадра без вылета - Маленькие видео (480p) не трогает — идут в оригинале - Можно переопределить вручную через dropdown: auto, 384, 448, 512, 768, original Работает с GGUF (llama.cpp) и Transformers (Hugging Face) #vlm VK | MAX
Обновление ComfyUI-QwenVL: оптимизация работы с видео

Перемонтированная версия видео о походе в ЦОД

P@prohitecавтор про «tech»
вчера
Вы могли уже видеть этот шедевральный фильм о походе в ЦОД. Но, к моему большому сожалению, в нынешних обстоятельствах видео потребовали удалить. Я договорился, что видео можно будет оставить, если вырезать некоторые фрагменты, поэтому я его немного перемонтировал. И желаю вам приятного просмотра! https://youtu.be/pbJNy49SNBs

Это всё на сейчас.