Z.ai представила мультимодальную модель GLM-5.3-Flash
A@ai_productAI-инженер
2 днZ.ai выпустила открытую модель GLM-5.3-Flash, ранее известную как Ox Alpha. Модель работает на китайских чипах и поддерживает мультимодальность.
Появление мощных и дешевых ИИ-моделей, работающих на альтернативном «железе», меняет экономику разработки.
- Модель демонстрирует возможность создания высокопроизводительных ИИ без использования чипов Nvidia.
- Существенное снижение стоимости API делает внедрение сложных агентских задач доступнее для бизнеса.
- Нативная мультимодальность позволяет модели напрямую работать с интерфейсами и офисными документами.
Z.ai выложила GLM-5.3-Flash – ту самую «загадочную» Ox Alpha
Все там писали кипятком, что же стоит за стелс-моделью Ox Alpha, которая бесплатно взлетела в топ по использованию. Сын же мой потестил и сказал, что что-то китайское и среднее по качеству, не понятно, отчего такие восторги (не слушайте блогеров).
Сегодня интрига закончилась – это Z.ai, и модель GLM-5.3-Flash, с открытыми весами под MIT, мультимодальная.
Короче, получилась такая:
– 320B параметров, из них активных всего 18B
– первая нативно мультимодальная модель в линейке GLM-5: картинки и видео на входе, 1M контекста
– гибридная архитектура sparse + linear attention – Z.ai говорит, что это первая открытая frontier-модель с такой связкой. Attention-вычислений в 3 раза меньше, KV-кэш в 4,4 раза компактнее, чем у большой GLM-5.3
– обучалась и крутится целиком на китайских чипах – без Nvidia
По цифрам заявляют паритет с Claude Opus 4.8 на кодинге и агентских бенчмарках и уверенное превосходство над GLM-5.2 – при цене в десять раз ниже. Отдельная фишка – «визуальный кодинг»: модель сама смотрит на отрендеренный интерфейс, находит косяки и правит, а ещё умеет доводить офисные задачи до готовых PPTX/XLSX/DOCX. Все остальное скорее всего будет так себе.
Цена, конечно, жесть:
– $0.15 за 1M входных, $0.50 за выходных, кэш $0.03 (официальный API)
– на OpenRouter сейчас вообще $0.075 / $0.25
– для сравнения, большая GLM-5.3 стоит $1.40 / $4.40, Opus – в разы дороже
Веса на Hugging Face, API уже живой, в Coding Plan дают тройную квоту.
Короче, скоро ИИ-ка будет вам кодить за чашку риса...
https://z.ai/blog/glm-5.3-flash

Кратко (AI)
Компания Z.ai официально представила модель GLM-5.3-Flash, которая ранее была известна под кодовым названием Ox Alpha. Модель является мультимодальной, имеет 320B параметров (18B активных) и работает на китайских чипах без использования оборудования Nvidia. Разработчики заявляют о высокой эффективности архитектуры и низкой стоимости API по сравнению с аналогами.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖