glm-5.3-flash
https://docs.z.ai/guides/vlm/glm-5.3-flashВыход мультимодальной модели GLM-5.3-Flash
M@ai_machinelearning_big_dataAI-инженер
2 днZ.ai представила GLM-5.3-Flash, первую нативно мультимодальную модель серии GLM-5 с оптимизацией под длинный контекст и работу с интерфейсами.
Новая модель делает работу с длинными документами и сложными интерфейсами значительно дешевле и быстрее.
- Снижение затрат на вычисления и память позволяет обрабатывать огромные объемы данных эффективнее.
- Нативная мультимодальность расширяет возможности модели для автоматизации работы в GUI и профессиональном ПО.
- Увеличенная квота в рамках подписки делает модель более доступной для интенсивных задач разработки.
🔥 GLM-5.3-Flash официально доступна
Новая модель Z.ai стала первой нативно мультимодальной моделью в серии GLM-5 и получила архитектуру, заточенную под дешёвый длинный контекст.
Главное:
* 320B параметров, активны 18B
* hybrid-архитектура: sparse attention + linear attention
* attention compute снижен в 3,01 раза
* KV-cache уменьшен в 4,44 раза
* контекст до 1 млн токенов
* нативная работа с изображениями и интерфейсами
* подходит для coding, browser/GUI-задач, Blender, Office, research и работы с документами
* в GLM Coding Plan даёт в 3 раза больше квоты, чем GLM-5.3
Model ID:

Кратко (AI)
Компания Z.ai выпустила модель GLM-5.3-Flash, которая стала первой нативно мультимодальной в линейке GLM-5. Модель оптимизирована для работы с длинным контекстом до 1 млн токенов и эффективного взаимодействия с интерфейсами, включая кодинг и офисные приложения.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖