Обновление ComfyUI-QwenVL: оптимизация работы с видео
Н@GreenNeuralRobotsAI-инженер
13 чВ ComfyUI-QwenVL добавлена автоматическая оптимизация токенов и масштабирование кадров для обработки видео высокого разрешения без ошибок OOM.
Инструменты для работы с видео в нейросетях становятся стабильнее и доступнее для обычных пользователей.
- Автоматическое масштабирование предотвращает вылеты программы при обработке тяжелых видео.
- Поддержка форматов GGUF и Transformers расширяет возможности запуска на разном железе.
- Гибкие настройки позволяют пользователям выбирать между скоростью и качеством обработки.
ComfyUI-QwenVL
запуск Qwen-VL внутри #ComfyUI - визуальное понимание и генерация текста.
Раньше при попытке скормить видео 1080p нода вылетала с OOM, теперь автоматический рассчет токенов и масштабирование кадров под контекст модели
- Умное масштабирование видео: 1080p/4K автоматически поджимается под безопасный бюджет токенов — 16-32 кадра без вылета
- Маленькие видео (480p) не трогает — идут в оригинале
- Можно переопределить вручную через dropdown: auto, 384, 448, 512, 768, original
Работает с GGUF (llama.cpp) и Transformers (Hugging Face)
#vlm
VK | MAX

Кратко (AI)
В расширение ComfyUI-QwenVL добавлена функция автоматического масштабирования видео для предотвращения ошибок нехватки памяти (OOM). Система теперь самостоятельно подстраивает разрешение кадров под лимит токенов модели, сохраняя при этом возможность ручной настройки.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖