токеныСбросить фильтр ×

Инструмент для анализа расхода токенов в Claude Code

T@tips_aiAI-инженер
14 ч

OpenRouter вырос в 9000 раз за 2,5 года

4 дн
OpenRouter вырос в 9000 раз за 2,5 года

Почему нельзя менять уровень «размышления» модели в ходе диалога

С@svyatamestoAI-инженер
1 нед
Почему нельзя менять уровень «размышления» модели в ходе диалога

Как оптимизировать расходы на токены в Claude Code

A@ai_productAI-инженер
2 нед

Появление «токен-брокеров» на сером рынке ИИ-кредитов

v@vcnewsмедиа / агрегатор
2 нед
На «сером» рынке ИИ-кредитов появились «токен-брокеры». Они предлагают стартапам продать неиспользованные токены или купить их неофициально с большой скидкой. Например, в Китае подобные сервисы продают доступ к Qwen под видом Claude, нанимают людей для прохождения верификации по фото и оплачивают доступ ворованными картами vc.ru/ai/3077176
Появление «токен-брокеров» на сером рынке ИИ-кредитов

Оптимизация использования лимитов в Codex

I@inspired_PMмедиа / агрегатор
2 нед
Оптимизация использования лимитов в Codex

Amazon потратил $1,8 млн лишних на токены Claude из-за незамеченной на 5 месяцев ошибки

Сотрудники Amazon случайно превысили бюджет на использование ИИ-модели Claudei)">i (Sonneti) на $1,8 млн — ошибку в настройке ИИ-агента не замечали пять месяцев, сообщила Financial Times. Проект, где произошёл сбой, должен был автоматически сопоставлять авторов с карточками книг на Amazon, но так и не заработал, зато сжёг огромные суммы на токенах.

Случай показывает новую категорию корпоративных рисков: простые программные ошибки, которые в обычных системах почти ничего не стоили бы, при работе с платными LLM превращаются в сотни тысяч и миллионы долларов незапланированных расходов.

$1,8 млнлишние расходы на токены Claude
860%превышение бюджета проекта
5 месяцевсрок, в течение которого ошибку не замечали

Полный разбор →

Headroom: инструмент для сжатия контекста ИИ-агентов

C@campcodeAI-инженер
3 нед
Срезаем ИИ-агентам аппетит — нашел на GitHub прикольную тулзу Headroom, которая сжимает логи, файлы, RAG-выдачу и результаты инструментов до отправки в модель. По собственным тестам проекта, это экономит 15–20% токенов у кодинг-агентов и до 60–95% на JSON 🤔 Headroom работает локально как библиотека, прокси или MCP-сервер, отдельно обрабатывает код, текст и структурированные данные. Оригиналы не пропадают: они остаются в локальном кэше, и агент может запросить нужный фрагмент обратно. Поддерживаются Codex, Claude Code, Copilot, Cursor и ещё пачка агентов — есть даже общая память между ними. Экономим токены смолоду 💃

Как экономить токены в Claude Code

Б@blognotAI-инженер
1 мес
Давно не писал в блог всякие статьи про Claude Code, но тут мне начали задавать вопросы "Как экономить токены?" и оказалось, что очень простые советы более чем актуальны. https://blognot.co/kak-eekonomit-tokeny-v-claude-code/

Сравнение динамики цен на ПК и токены нейросетей

G@aiofthedayAI-инженер
1 мес
Синяя линяя — история падения цены на персональные компьютеры (с учетом производительности). Красная — как падает цена токенов нейросетей. Желтая — как падает цена токенов с учетом "ума" этих токенов. Я взял здесь, но они не первоисточник и деталей расчетов не дают, красную линию очень по-разному считать можно. Но в желтой сомнений нет, да.

Параллели между работой ИИ-агентов и сотрудников

P@ruspmпродакт / фаундер
1 мес

RTK: CLI-прокси для оптимизации потребления токенов LLM

Н@GreenNeuralRobotsAI-инженер
1 мес
RTK (Rust Token Killer) CLI-прокси для существенного сокращения потребления токенов LLM при работе с командами разработки. Работает как единый бинарный файл на Rust без внешних зависимостей. • Сокращает потребление токенов на 60-90% для типовых команд разработки • Фильтрует и сжимает вывод команд перед отправкой в LLM • Поддерживает более 100 команд разработки • Задержка менее 10мс • Работает с Claude, Copilot, Gemini и другими ИИ-инструментами Экономия на типовых операциях: • ls/tree 80% • cat/read 70% • grep/rg 80% • git status 80% • git diff 75% • тесты и линтеры до 90% #optimization #coding

Как на самом деле работают LLM

Х@habr_comмедиа / агрегатор
1 мес

Goldman Sachs прогнозирует 24-кратный рост потребления токенов AI-агентами к 2030 году

1 мес

pxpipe: как перевод контекста в PNG экономит до 70% токенов Fable 5

Разработчики нашли способ обойти дорогую текстовую тарификацию нейросети Fable 5 (Claude) от Anthropic: утилита pxpipei кодирует объёмный контекст — системные промпты, документацию инструментов и историю переписки — в PNG-картинки перед отправкой в Claude Code. Изображения тарифицируются по количеству пикселей, а не по числу символов, поэтому длинный контекст обходится заметно дешевле.

В тестах стоимость сессии упала с $42 до $6 — то есть в 7 раз, а по расчётам одного из авторов экономия составляет 59–70%. Fable 5 при этом почти без потерь распознаёт текст на картинках, но у других моделей (Opus 4.7, 4.8, GPT 5.5) метод даёт заметный процент ошибок.

59–70%снижение стоимости запроса к Fable 5
$42 → $6падение стоимости тестовой сессии
≈7%доля ошибок Opus 4.7/4.8 на картиночном контексте

Полный разбор →

Anthropic временно вернула Fable 5 в подписку Claude, но усилила фильтры модели

Anthropic снова открыла доступ к модели Fable 5 в рамках обычной подписки Claude — для тарифов Pro, Max, Team и Enterprise. С 1 по 7 июля 2026 года на неё можно потратить до 50% недельного лимита подписки бесплатно, а после — доступ переходит на платные usage creditsi сверх плана.

Одновременно с возвращением компания заметно затянула гардрейлыi: модель стала чаще перекидывать спорные запросы на Opus 4.8i. Пользователи уже жалуются, что Fable 5 отказывается писать и проверять безобидный код, читать статьи по кибербезопасности и решать школьные задачки по химии.

50%доля недельного лимита на Fable 5
$50/M токеновцена usage credits после подписки
7 июля 2026дата окончания бесплатного доступа

Полный разбор →

Плагин Caveman заставляет ИИ-агентов говорить «как пещерный человек» для экономии токенов — но независимая проверка нашла экономию в разы меньше заявленной

Разработчик Джулиус Брюсси (Julius Brussee) выложил на GitHub плагин Cavemani, который переписывает системные промпты Claude Code, Codex, Gemini и 30+ других ИИ-агентов так, чтобы модель отвечала телеграфным стилем без вежливости, приветствий и «воды» — например: «Баг найти. Исправить. Хороший код». Автор заявляет экономию до 65-75% токенов при сохранении технического смысла, и плагином, по данным источников, пользуются сотрудники Nvidia, GitHub и даже OpenAI.

Историю подхватило 404 Media, а независимые проверки дали противоречивые результаты: если 404 Media получили около 65% экономии, то оценка от JetBrains (проведённая автором канала Denis Sexy IT) показала лишь 8% — то есть заявленные цифры могут быть сильно преувеличены.

65-75%заявленная автором экономия токенов
8%реальная экономия по оценке JetBrains
80кзвёзд репозитория на GitHub

Полный разбор →

Это всё на сейчас.