Nvidia адаптирует оборудование под китайские ИИ-модели



21 августа DeepSeek анонсировала экспериментальную мультимодальную версию своего флагмана — deepseek-v4-flash-vision-expi. Модель научилась работать с изображениями (скриншоты, документы, графики, диаграммы) в паре с текстом, при этом текстовые способности (агентность, reasoning, знания) остались на уровне обычной V4-Flash.
Главный фокус — агентные сценарии, где ИИ нужно «видеть» экран. По мультимодальным агентским бенчмаркам новинка сделала большой скачок и подошла вплотную к Claude Opus 4.8, а по некоторым тестам даже опередила её — и всё это по ценам обычной Flash-модели.

DeepSeek опубликовала DeepSeek Harnessi (dsh) — open-source инфраструктурный слой для превращения обычных ИИ-моделей в автономных агентов, аналог обвязки вокруг Claude Code/OpenCode/Codex. Идея проекта — «everything is a plugin»: модель, инструменты, skills, sandbox, память, permission policy, UI и даже суб-агенты (можно подключить Claude Code или Codex) собираются как отдельные плагины. Проект основан на мета-фреймворке Cordisi, распространяется по MIT-лицензии и не требует использования именно API DeepSeek — можно подключить любого провайдера или локальную модель.
Репозиторий стал одним из самых быстрорастущих в истории GitHub: 122K+ звёзд за 3 дня и уже более 140к звёзд спустя несколько дней — быстрее, чем в своё время набирал звёзды OpenClaw. Почти одновременно с релизом DeepSeek подняла цену на cache-hit inputi в 6–12 раз, а именно этот тип токенов больше всего расходуют агентные циклы, которые Harness делает массовыми — на это обратили внимание наблюдатели.
В Пекине заработал бар под названием AGI Bari, где посетителям вместо привычного бесплатного Wi-Fi предлагают бесплатный неограниченный доступ к токенам модели DeepSeek V4 Flashi. Модель крутится локально на двух рабочих станциях Nvidia DGX Sparki, стоящих прямо за барной стойкой — можно взять напиток и спокойно кодить без подписок.
Заведение оформлено в духе индустрии ИИ: на стенах логотипы ИИ-компаний, на экранах — вакансии нейролабораторий, а фирменный коктейль называется «AGI» и представляет собой стакан почти сплошной пены — шутка про пузырь вокруг ИИ.

С 16 августа 2026 года DeepSeek меняет тарификацию API для флагманских моделей V4 Flashi и V4 Proi: вместо единой низкой цены компания вводит зависящую от времени суток стоимость с пиковыми и льготными часами. Даже в льготные часы цена окажется выше текущей, а в пик — вырастет кратно.
Это фактически конец эпохи «сверхдешёвого» DeepSeek — компания отказывается от прежней стратегии демпинга и переходит на модель динамических тарифов, привязанных к загрузке вычислительных ресурсов.


Китайская DeepSeek после почти четырёх месяцев тестирования вывела из preview флагманскую модель DeepSeek V4 Pro версии 0813: она развернута в DeepSeek API и DeepSeek Chat, веса опубликованы на HuggingFace под лицензией MIT. Это MoEi-модель на 1,6 трлн параметров (~49 млрд активных на токен), с контекстом до 1 048 576 токенов и ответом до 384К токенов, ориентированная на программирование, рассуждения и долгие агентные задачи.
Главная фишка релиза — цена: $0.435 за 1 млн входных токенов и $0.87 за выходные, что по независимым оценкам делает модель кратно дешевле конкурентов при близком качестве. Одновременно DeepSeek выпустила собственный модульный агентный харнесс DeepSeek Harnessi, но уже с 16 августа обещает поднять цены API, причём в пиковые часы — вдвое.