В сообществе Нейронавт показали технику переноса «чувства детализации» от Z-Imagei — компактной 6B image-модели, хорошо прорабатывающей текстуры, — в чекпоинты других видео-движков без переобучения и изменения архитектуры. Сначала приём применили к MiniMax-H3i, затем к Joy-LTX 2.5.
Результат: окружение, материалы и лица становятся заметно детальнее (краска, ржавчина, вода, солома, листва, кожа), при этом видео, звук и поведение базовой модели не меняются, а детализация не «плывёт» между кадрами при склейках.
6Bразмер модели Z-Image
21.5 GBобъём кванта Q8_0
11.5/19.9 GBобъём кванта Q4_0
- MiniMax-H3 × Z-Image ставится как прямая замена стандартных H3-чекпоинтов, менять воркфлоу не нужно
- Доступны GGUFi-кванты под разный VRAM: Q4_0 (11.5/19.9 GB), Q5_1 (15.2/25.9 GB), Q8_0 (21.5 GB)
- Рекомендация автора по выбору кванта (версии curve-zs05): 16 GB VRAM → Q4_0, 24 GB → Q5_1, 32 GB → Q8_0
- По данным второго поста, версию MiniMax-H3 в чате раскритиковали
- Joy-LTX 2.5 × Z-Image: солома читается как отдельные стебли, листва — как листья, кожа держит структуру, а не выглядит как пластик
- У Joy-LTX 2.5 движение, звук и поведение модели остаются как у базовой версии
- Авторы наработок: @EvgenyiPerm (MiniMax-H3) и @m_franz (Joy-LTX 2.5)
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖