Релиз модели Qwen 3.8 Flash Next
э@ai_newzAI-инженер
2 днВышла новая модель Qwen 3.8 Flash Next с архитектурой Qwen 4, оптимизированная для локального запуска на мощных рабочих станциях.
Появление эффективных моделей для локального запуска позволяет компаниям и разработчикам использовать мощный ИИ без облачных сервисов.
- Снижение зависимости от облачных API за счет оптимизации под локальное железо.
- Возможность запуска моделей высокого уровня на рабочих станциях с 128 ГБ памяти.
- Поддержка популярными фреймворками vLLM и SGLang упрощает внедрение в существующие проекты.
Расчехляйте свои DGX Spark и макстудии — вышла Qwen 3.8 Flash Next
Это 125B-A6B модель с 51B Engram параметров на архитектуре Qwen 4. Обходит по всем бенчам Qwen 3.8 27B, очень хорошо соревнуется с DeepSeek V4 Flash. Модель уже поддерживается vLLM и SGLang.
Очень интересный форм-фактор для моделей, позволяющий эффективно их запускать на локальных машинах с 128gb памяти — DGX Spark, Mac, Strix Halo, нужно таких моделей побольше.
Блогпост
Техрепорт
Веса
@ai_newz

Кратко (AI)
Представлена новая языковая модель Qwen 3.8 Flash Next, построенная на архитектуре Qwen 4. Модель обладает 51B Engram параметров и оптимизирована для эффективного запуска на локальном оборудовании с 128 ГБ оперативной памяти.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖