📅 TL;DR недели 33
Попробуем такую рубрику для занятных
Неделя открытых весов: три релиза подряд, и каждый по-своему про то, что фронтир протекает вниз.
Meta первой за полтора года выложила открытую модель — Muse Glimmer 30B, dense, Apache 2.0, заточенная под локальный запуск. Я потратил на неё день на MacBook Air M5 и
написал большой текст: 7 квантизаций, линейная кривая скорости, спекулятивный декодер DFlash, который вместо обещанного ускорения дал −60%, и неожиданный пол по размеру файла, на котором ломается модель «всё решает пропускная способность».
DeepSeek тихо, без ивента и блог-поста, подменил алиас на V4-Pro-0813. Архитектура та же, всё интересное в посттрейне: Terminal-Bench 2.1 с 72 до 88, DeepSWE — рост в пять раз. При цене $0.435/$0.87 это примерно 57× дешевле Fable 5 за 0.1 пункта разницы. Оговорки важнее цифр: бенчмарки вендорские и мерялись собственным харнессом, независимый AA Index даёт 53 против 63 у Opus 5, зрения нет вообще, а цены обещают поднять. В тот же день харнесс открыли под MIT — разобрал его отдельным
лонгридом.
Qwen выкатил сначала 2.4-триллионный Max, а следом то, чего
все ждали — 3.8-27B. Apache 2.0, 262K контекста, ~17 ГБ в четырёх битах, то есть одна потребительская видеокарта. Сравнивать его с прошлым поколением скучно, поэтому сравнил с GPT-5 годичной давности: на одном снапшоте индекса даже апрельский 3.6-27B уже обгоняет флагман августа 2025. Если заявленные цифры 3.8 переживут независимую проверку — это уровень Gemini 3.1 Pro и Opus 4.6 дома за стоимость электричества.
Плюс
Grok 4.7 с удвоенными лимитами в Cursor и Grok Build, а в выходные смотрели —
четырёхчасовой видос про ffmpeg
Пишите, что вы думаете про такой формат.
#TLDR
@techn0danya