Тестирование Deepseek V4 Flash через Ollama
К@kdoronin_blogAI-инженер
3 недАвтор тестирует модель Deepseek V4 Flash через Ollama, отмечая высокую эффективность использования лимитов подписки по сравнению с другими моделями.
Эффективность новых моделей ИИ позволяет значительно снизить затраты на API и подписки.
- Deepseek V4 Flash демонстрирует высокую производительность при низком потреблении лимитов.
- Использование локальных инструментов типа Ollama помогает оптимизировать работу с облачными моделями.
- Сравнение лимитов разных сервисов показывает, что выбор модели напрямую влияет на стоимость разработки.
После выхода наделавшего шума Deepseek V4 Flash, вспомнил, что у меня есть подписка за $20 на ollama. Иногда гоняю там cloud-модели.
Запустил на Flash несколько тестовых задач, чтобы посмотреть, на что модель вообще способна.
Он оказался достаточно хорош в пространственном мышлении и даже сделал мне что-то вроде "Angry Birds" в 3D. Ещё и через специфический харнесс от paperclip.
Особенно меня впечатлило то, как на Ollama он ест лимиты на подписке за $20. 2307 запросов заняли меньше 10% недельных лимитов.
Возможно, есть некоторое смещение восприятия, вызванное GPT-5.6-Sol, съедающим недельные лимиты за сутки, если чуть отпустить вожжи. Или даже Cursor, который в прошлом году за $20 давал всего 500 запросов в месяц к "не-auto" моделям.

Кратко (AI)
Автор делится опытом использования модели Deepseek V4 Flash через Ollama. Он отмечает высокую производительность модели в задачах на пространственное мышление и крайне экономное расходование лимитов подписки по сравнению с GPT-5.6-Sol и Cursor.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖