Почему Claude Sonnet 5 оказался дороже Opus 4.8 в реальных задачах
N@neuro_art0AI-инженер
1 месАвтор анализирует реальную стоимость использования Claude Sonnet 5 и Opus 4.8, приходя к выводу, что флагман выгоднее для сложных агентных задач.
💸 Я откатываю свои ИИ-рутины с Sonnet 5 обратно на Opus 4.8
Пару недель назад, как только вышел Claude Sonnet 5, я шустро перевёл на него штук пять своих рабочих рутин. Обещали красиво: лучше, быстрее и почти такой же умный, как Opus, только дешевле. Прошло две недели — и я меняю модель обратно. Сел, разобрался в цифрах, и картина оказалась ровно противоположной обещанной.
1. Скрытая наценка ~30% через токенайзер. Вместе с Opus 4.7 Anthropic сменила токенайзер — тот же текст теперь дробится на до 35% больше токенов, это признаёт даже документация самой Anthropic. Ставка за токен «не менялась» — но платишь-то за количество. С Opus 4.7 это уже проходили: у людей счёт вырос на 27%, хотя на странице цен ничего не поменялось. The Decoder зовёт это паттерном скрытого повышения цен.
2. Дороже за реальную задачу. Независимый замер Artificial Analysis: полный прогон Intelligence Index обошёлся в $2.29 за задачу на Sonnet 5 против $1.97 на Opus 4.8. «Дешёвая» модель по факту вышла дороже флагмана — потому что жрёт ~40% больше выходных токенов и делает втрое больше шагов.
3. Тупее на ровном месте. И это не за «больше ума» — наоборот. Opus 4.8 сейчас — первая модель мира на Intelligence Index (61.4), Sonnet 5 — 53. На агентном кодинге SWE-bench Pro — 69% против 63%. Для рутин это реально сорвавшиеся прогоны и лишние итерации.
4. Заставишь думать — сожрёт больше Opus. Поднимаешь effort, чтобы вытянуть качество, — и Sonnet 5 по стоимости обгоняет Opus 4.8 при сопоставимом результате. А сам Opus 4.8 при этом стал ещё и экономнее: ту же работу делает на 15% меньшим числом шагов и с 35% меньшим числом токенов, чем 4.7.
Честно, где Sonnet 5 хорош: простые задачи на низком усилии (суммаризация, классификация, извлечение) и период вводной цены ($2/$10 до 31 августа) — там он реально дешевле. Но мои рутины — многошаговые агентные прогоны, где включаются и токенайзер, и мышление, и лишние итерации. Именно там математика разворачивается против него.
Вывод. «Премиальный» ценник Opus 4.8 оказался дешевле в пересчёте на выполненную работу — и умнее. Мораль: считайте стоимость по задаче, а не по ставке за токен. Именно на этой подмене построена вся «экономия».
🎯 НЕЙРО-ПУШКА ● НОВОСТИ И ОБЗОРЫ НЕЙРОСЕТЕЙ
Кратко (AI)
Автор поста делится опытом возврата с модели Claude Sonnet 5 на Opus 4.8, аргументируя это тем, что новая модель обходится дороже в сложных агентных задачах из-за особенностей токенизации и большего количества итераций. Несмотря на маркетинговое позиционирование Sonnet 5 как более дешевого решения, реальные замеры показывают, что Opus 4.8 эффективнее и экономичнее при выполнении комплексной работы.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖