Компания DeepSeek представила обновленную версию модели V4-Flash-0731, которая вышла в публичную бету API. Модель сохранила архитектуру с 284 млрд параметров (13 млрд активных), но прошла через новый этап пост-тренинга, сфокусированный на агентных задачах, кодинге и рассуждениях.
Обновление значительно улучшило производительность модели, позволив ей конкурировать с топовыми решениями уровня GLM-5.2, Opus 4.8 и GPT-5.5, при этом предлагая существенно более низкую стоимость использования. Модель уже доступна для интеграции через API и локального запуска.
284Bобщее количество параметров модели
$0.28стоимость миллиона выходных токенов
1 млнмаксимальный размер контекстного окна
- Модель показывает 82.7 на Terminal-Bench 2.1 и 54.4 на DeepSWE, опережая версию V4-Pro-Preview.
- Добавлена нативная поддержка Responses API, параллельные вызовы инструментов и адаптация под Codexi для работы в VS Code.
- Контекстное окно модели увеличено до 1 млн токенов.
- Стоимость использования составляет $0.14 за миллион входных токенов и $0.28 за миллион выходных, с ценой кэширования $0.0028.
- Модель является текстовой (text-only) и доступна для скачивания на Hugging Face, включая GGUF-версии от Unsloth.
- По данным Artificial Analysis, модель демонстрирует высокую эффективность использования токенов, что делает её экономически выгодной альтернативой GPT-5.6 Luna.
Официальный релиз более мощной модели DeepSeek-V4-Pro ожидается в первых числах августа.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖