14 августа 2026 года Alibaba релизнула Qwen3.8-27B — мультимодальную dense-модель на 27 млрд параметров с открытыми весами (лицензия Apache 2.0i), которую можно запускать на одной домашней видеокарте. По бенчмаркам Alibaba модель обходит собственную облачную Qwen3.7-Plus и местами превосходит Claude Opus 4.6 Max, при этом умеет работать с кодом, агентными сценариями, изображениями и видео.
Релиз показателен для всей индустрии: китайские открытые модели быстрее прогрессируют, чем закрытые западные аналоги, и по некоторым замерам уже опережают флагманов уровня GPT-5 при кратно меньшей стоимости эксплуатации. Несколько авторов отмечают, что главным недостатком локальных моделей остаётся не «глупость», а скорость работы.
- Бенчмарки (данные Alibaba, поколение к поколению): Terminal-Bench 2.1 — 73.0 против 63.4 у Qwen3.6; SWE-bench Proi — 61.7, LiveCodeBench — 90.3, OSWorld-Verified — 84.3, AndroidWorld — 81.9
- Контекст — 262 144 токена нативно, расширяется до 1 000 000 через YaRNi; поддерживаются thinking mode с настраиваемым reasoning_effort, preserve_thinking (сохранение цепочки рассуждений между сообщениями) и tool use для агентов
- Требования по железу: RTX 3090/4090 (24 ГБ) — оптимально, Q4-квант занимает 17–18 ГБ; на 16 ГБ нужен Q3 или частичная выгрузка в ОЗУ; RTX 5090 (32 ГБ) держит Q6/Q8; на CPU достаточно 32 ГБ RAM для медленного Q4, комфортнее 64 ГБ; полная BF16-версия — около 56 ГБ, нужна серверная карта или несколько GPU
- Ранее в августе 2026 Alibaba представила флагманскую облачную Qwen3.8-Max (2,4 трлн параметров, 95 млрд активных), сначала доступную только в QwenCloud, а затем открыла её веса; Qwen3.8-27B выпущена вслед за ней как модель для мощного ПК
- По данным канала «техноданя», на индексе Artificial Analysis (снапшот v4.1.x) GPT-5 (high, флагман августа 2025) набирает 35 баллов, а вышедшая ещё в апреле 2026 Qwen3.6-27B — 38, то есть уже обгоняла GPT-5 на 3 пункта; для сравнения GPT-5 в 2025 году стоил $1.25/$10 за млн токенов и работал только в датацентре OpenAI, а Qwen3.6-27B — на домашней машине за стоимость электричества
- Игорь Акимов (AI Product) сообщает, что при тестах извлечения данных на английском, французском и немецком языках в закрытой европейской системе модель Qwen3.6-35B-A3B «за копейки порвала всех» — включая модели, продвигаемые европейскими провайдерами как «суверенные» и безопасные
- На той же неделе, по данным @ai_newz, вышла ещё одна локальная модель — Muse Glimmer, а также релизы моделей побольше
Автор канала «техноданя» обещает отдельный лонгрид с практическим тестом запуска модели на потребительском железе; ожидается, что модель станет доступна через Transformers, vLLM, SGLang, а также llama.cpp, Ollama и LM Studio.
Это произошло: MiniMax выпустил открытую модель генерации музыки с вокалом Music 3 →
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖