← к умной ленте

Дайджест AI за неделю: веса Kimi K3, снижение цен GPT‑5.6, обновление DeepSeek V4 Flash и новые видео- и робот-модели

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 3 нед назад

На неделе с 27 июля по 2 августа 2026 вышло сразу несколько крупных релизов в LLM и генеративных моделях. Moonshot AI открыли веса своей крупнейшей модели Kimi K3 (2.8T параметров), OpenAI снизили цены на линейку GPT-5.6 и представили математическую мультиагентную модель Astra, а DeepSeek обновили V4 Flash без изменения архитектуры. Параллельно ByteDance и MiniMax выпустили новые генераторы видео, а Google DeepMind — модель для управления роботами.

События показывают, что гонка идёт одновременно по нескольким фронтам: открытые веса больших LLM, снижение цены токена, доказательства математических теорем через ИИ и мультимодальная генерация видео/аудио с точным контролем движения.

2.8Tпараметров Kimi K3
$0.14/$0.28цена за млн токенов DeepSeek V4 Flash
180 секундмакс. длина видео Seedance 2.5
  • Moonshot AI выложили полные веса Kimi K3: 2.8T параметров, 104B активных, 896 экспертов (16 активны одновременно), контекст 1М токенов; веса сразу квантованы в MXFP4i, для локального запуска нужна система с 2 ТБ памяти.
  • OpenAI снизили цены на GPT-5.6: Luna подешевела в 5 раз (до $0.2/$1.2 за млн токенов), Terra — на 20%; для флагмана Sol добавлен Fast-режим, работающий в 2.5 раза быстрее, но по цене в 2 раза выше обычного.
  • Мультиагентная модель Astra от OpenAI доказала 10 открытых математических задач с помощью системы Leani, потратив менее $2000 на токены по расценкам Sol.
  • DeepSeek выпустили посттренинг-версию V4 Flash 0731 (архитектура и размер не менялись): 82.7% на Terminal-Bench 2.1, 54.4% на DeepSWE, 70.3% на Toolathlon Verified; цена $0.14/$0.28 за млн токенов, кэшированный ввод — $0.0028; модель совместима с Codex и по данным ai_newz обходит GLM 5.2, оставаясь дешевле Luna. Релиз V4 Pro ожидается в начале августа.
  • ByteDance Seedance 2.5: по данным ai_newz, модель генерирует ролики до 180 секунд, получила интеграцию с Blender и точечное редактирование, но стала самой дорогой на рынке ($6 за 30 сек); по данным «Борис опять», модель делает 4K-видео до 30 секунд за проход, принимает до 50 референсов (30 изображений, 10 видео, 10 аудио, сценарии, раскадровки, описания персонажей), поддерживает перенос движения через хромакей-видео или анимацию 3D-болванки, а режим на 5–180 секунд с несколькими сценами — это отдельная надстройка extended mode в Dreamina.
  • MiniMax представили мультимодальную модель H3: принимает текст, изображения, видео и аудио, выдаёт видео до 15 секунд в 2K с нативным стереозвуком, умеет редактировать картинки/видео/аудио, переносить движение и работать с референсами и multi-shot; полные веса и техрепорт обещают открыть позже.
  • Google DeepMind выпустили Gemini Robotics ER 2: модель анализирует непрерывный видеопоток, разбивает задачу на шаги, передаёт команды VLA-моделям и другим контроллерам, проверяет выполнение, может думать и действовать параллельно, вызывать Google Search и пользовательские функции, замечать ошибки и повторять неудачные шаги, а также координировать несколько роботов на одной задаче; доступна через Gemini API и AI Studio.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖