Обзор новых GGUF-квантов и официальных весов для модели MiniMax H3, включая варианты FL2VA и Ref2VA для ComfyUI.
Обновы для Минимакса H3
Новые GGUF-кванты
- FL2VA - T2V, I2V, первый и последний кадр
- Ref2VA - изображения, видео и аудио как референсы
- Q3_K_S / Q3_K_M - 15.6 ГБ
- Q4_0 - 18.6 ГБ
- Q4_K_S / Q4_K_M - 19.9 ГБ
- Q5_0 - 22.8 ГБ
- Q5_K_S / Q5_K_M - 23.9 ГБ
Там же появился Q4_K_M-квант Qwen3-VL-32B text encoder размером 14.6 ГБ.
То есть минимальный комплект «трансформер + энкодер + VAE» теперь можно собрать как бы компактнее прежнего варианта с NVFP4-энкодером на 27.1 ГБ. Там же есть готовые workflow для FL2VA и Ref2VA.
Пока это самопальные кванты, а не официальный релиз Comfy
https://huggingface.co/Abiray/MiniMax-H3-GGUF
Новые официальные варианты от Comfy-Org и Kijai
В официальном репозитории Comfy-Org появились:
-
minimax_h3_fl2va_pruned_bf16.safetensors
-
minimax_h3_ref2va_pruned_bf16.safetensors
-
minimax_h3_fl2va_pruned_fp8_scaled.safetensors
-
minimax_h3_ref2va_pruned_fp8_scaled.safetensors
Pruned BF16 были загружены Kijai около 16 часов назад. Типа качество BF16 полного 66-гигабайтного трансформера. FP8 scaled появились немного раньше и должны стать промежуточным вариантом между BF16 и pruned INT8 по памяти и точности.
https://huggingface.co/Comfy-Org/MiniMax-H3/commits/main
Минимаксенко обрастает мясом. Новый ЛТХ. Ждем Ответа Флюксовицкого.
На видео сравнение Flux.3 API и MinimaxH3
Подписать не могу, гадайте сами.. Смышленые посмотрят длительность.
@cgevent
Кратко (AI)
Для модели MiniMax H3 стали доступны новые GGUF-кванты, позволяющие запускать модель с меньшими требованиями к видеопамяти. Также в официальном репозитории Comfy-Org появились оптимизированные веса в форматах BF16 и FP8, что упрощает интеграцию модели в рабочие процессы ComfyUI.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖