Moonshot AI представила Kimi K3 — открытую языковую модель на 2.8 триллиона параметров, что более чем в полтора раза крупнее прежних топовых опенсорс-моделей (1.6T). По ряду бенчмарков и в голосовании живых разработчиков она впервые обошла закрытые флагманы Claude Fable 5 и GPT-5.6, а модели чуть старше — Opus 4.8 и GPT-5.5 — отстали заметно. Модель заточена под фронтенд/веб-разработку, 3D и агентные задачи.
Событие значимо тем, что впервые опенсорсная модель возглавила публичные рейтинги — арену, где голосуют люди, Frontend Code Arenai и агентный бенчмарк «LLM под капотом». Спрос на модель оказался настолько высоким, что Moonshot временно приостановила приём новых подписок из-за нехватки мощностей, а на американских биржах прошла распродажа акций производителей полупроводников — рынок пересчитывает реальный разрыв между США и Китаем, работающим в условиях запрета на покупку топовых чипов Nvidia.
- По AA Intelligence Indexi (~10 бенчмарков) Kimi K3 обходит Fable 5 и GPT-5.6, а Opus 4.8 и GPT-5.5 отстают; при этом сама Moonshot (по данным источника 4) признаёт отставание от Fable 5 и GPT-5.6 по общим замерам, но лидирует в кодинге и агентных задачах
- Архитектура: собственный механизм линейного внимания Kimi Delta Attention (KDA, ускоряет декодирование до 6.3×), Attention Residuals, 896 экспертов из которых активны 16 — это даёт 2.5-кратный рост эффективности масштабирования; в отличие от DeepSeek модель не использует mHC
- В Frontend Code Arena (слепое тестирование живыми разработчиками) K3 заняла 1-е место с 1679 очками, обогнав Fable 5 и поднявшись с 18-го места предыдущего поколения; также #1 на SpreadsheetBench 2 и nextjs.org/evals (впервые опенсорс обогнал все закрытые модели), #2 на Vibe Code Bench (85.0%)
- Цена API — $3 за млн входных токенов и $15 за млн выходных (как у Claude Sonnet), плюс $0.3 за кэш; модель «разговорчива», и полный прогон AA Intelligence Index стоит столько же, сколько GPT-5.5 xhigh, и вдвое дороже GPT-5.6 Sol High, хотя дешевле Opus и Sonnet; пример из блога — клон CS:GO × Portal через API обошёлся в $3.24 против $10.80 на Claude Fable 5
- Скорость в официальном API через OpenRouter — всего 23 токена/сек, заметно медленнее проприетарных моделей; ожидается улучшение после выхода весов и подключения сторонних провайдеров
- По оценке канала «LLM под капотом», на агентном бенчмарке Kimi K3 сравнима по очкам с GPT-5.5 Pro, но примерно в 15 раз дешевле и в 2 раза быстрее, сдвигая оба Парето-фронта; минусы — огромный размер и больше пропущенных уязвимостей
- Полные веса и техотчёт обещаны до 27 июля 2026; пока доступ есть через Kimi, Kimi Work, Kimi Code и API; контекст модели — 1 млн токенов с нативным зрением
Полные веса и подробный технический отчёт Moonshot AI обещаны до 27 июля 2026 — после их выхода ожидается появление сторонних провайдеров, что может снизить цену и увеличить скорость (сейчас 23 токена/сек на OpenRouter). Также стоит следить, устоят ли текущие лидерские позиции модели после публикации полного отчёта и независимых замеров, и как отразится релиз на рынке полупроводниковых акций.
Это произошло: Moonshot AI приостановила продажу подписок на Kimi K3 из-за перегрузки GPU →
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖