Китайский стартап Moonshot AI (при поддержке Alibaba) 16 июля 2026 года выпустил флагманскую модель Kimi K3 — MoEi-модель на 2,8 трлн параметров с контекстным окном до 1 млн токенов. Модель уже доступна в чате, API, Kimi Code CLI, Kimi Work и в кодинг-подписке; полные веса компания обещает опубликовать не позднее 27 июля 2026 года, что делает K3 крупнейшей открытой ИИ-моделью в мире.
По бенчмаркам K3 уверенно превосходит Claude Opus 4.8, но, по большинству оценок, не дотягивает до закрытых лидеров — Claude Fable 5 и GPT-5.6 Sol (хотя Data Secrets отмечает, что разрыв с ними «далеко не везде» большой). При этом модель заняла первое место на Frontend Code Arena, обогнав Fable 5, и стоит как Claude Sonnet — заметно дороже прежних китайских моделей, но дешевле по стоимости на задачу, чем Opus 4.8. Axios и 3DNews называют релиз сигналом того, что технологическое лидерство США в ИИ быстро сокращается.
- Архитектура: 896 экспертов, из которых активны только 16 (Stable LatentMoE), новый механизм внимания Kimi Delta Attention (KDA)i для эффективной работы с длинным контекстом, а также Attention Residuals (AttnRes), Quantile Balancing, Per-Head Muon, SiTU, Gated MLA и quant-aware тренировка (веса MXFP4, активации MXFP8) — суммарно это дало ~2,5x к эффективности скейлинга относительно предыдущей K2.
- Цена API: $3 за млн входных токенов и $15 за млн выходных (уровень Sonnet), при автоматическом кэшировании закэшированные токены стоят $0.30 (скидка 90%), хитрейт кэша в кодинг-нагрузках превышает 90%; при этом K3 тратит на 21% меньше токенов на ответ (по данным How2AI), из-за чего стоимость на задачу примерно в 2 раза ниже, чем у Opus 4.8.
- По данным Artificial Analysis, Elo модели — 1547; на Frontend Code Arena K3 набрала 1679 pts и заняла №1 в 6 из 7 доменов (Brand & Marketing, Reference-Based Design, Data & Analytics, Consumer Product, Simulations, Content Creation Tools); также лидирует на BrowseCamp и занимает 3-е место на GDPval.
- По данным Хайтек+, K3 на 75% крупнее DeepSeek V4 Pro; ранние утечки Financial Times (до релиза) говорили о 2–3 трлн параметров и обещали, что модель обойдёт Opus 4.8 в бенчмарках — это подтвердилось.
- CodeCamp отмечает, что в соцсетях K3 ошибочно называли «открытым исходным кодом», хотя на момент релиза доступ шёл через закрытый API — реальные веса обещаны только к 27 июля.
- По словам Data Secrets, тизер-видео к релизу K3 было полностью смонтировано самой моделью из 56 сырых видеофайлов; по данным техноданя, K3 также самостоятельно за 48 часов спроектировала чип под нано-версию себя же.
- Модель чувствительна к истории «мышления» — разработчики советуют не переключаться на K3 посреди сессии другой модели и явно задавать границы поведения в системном промпте, так как модель может быть излишне инициативной.
Moonshot обещает опубликовать полные веса Kimi K3 не позднее 27 июля 2026 года, после чего сравнения с Fable 5 и GPT-5.6 Sol можно будет проверить независимо; также ожидается расширение режимов reasoning (low/high, сейчас доступен только max) и реакция конкурентов — в частности, xAI анонсировала обновление Grok с обещанием эффективности уровня K3 при скорости текущего Grok 4.5.
Это произошло: Alibaba анонсировала Qwen3.8 с 2,4 трлн параметров в ответ на Kimi K3 →
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖