← к ленте

Регрессия моделей Anthropic в следовании схемам инструментов

Б@blognotAI-инженер
1 мес

Армин Ронахер обнаружил, что Opus 4.8 и Sonnet 5 некорректно формируют аргументы инструментов, добавляя лишние поля, из-за особенностей обучения Claude Code.

Армин Ронахер (мне как-то уже поправляли транскрипцию именно его имени, но вроде так правильно?) обнаружил, что новейшие модели Anthropic — Opus 4.8 и Sonnet 5 — систематически ломают в Pi вызовы инструмента редактирования файлов, добавляя в аргументы выдуманные поля вроде requireUnique или oldText2, которых нет в схеме. Предыдущие версии моделей семейства такой ошибки не показывают, то есть флагманы регрессировали именно в следовании чужой схеме инструмента. Сами правки при этом корректны побайтово: модель решает задачу, но не может точно воспроизвести формат. В агентных сессиях с длинной историей сбой возникал примерно в 20% случаев, а строгий режим валидации его полностью устранял. Армин попробовал разобрать код Claude Code и вроде бы нашел причину. Собственный клиент Anthropic молча чинит испорченные вызовы — принимает алиасы параметров, исправляет битый Unicode и отфильтровывает неизвестные ключи. Если обучение с подкреплением идёт в таком всепрощающем окружении, слегка кривой вызов всё равно завершает задачу и получает награду. В итоге модель жёстко привязывается к плоской схеме инструментов Claude Code, а любая альтернативная форма оказывается вне обучающего распределения. Самый простой вывод — используйте родной харнесс моделей, тем более, что Claude Code очень хорош в этом смысле. А еще, кажется, он заметно экономит лимиты — я несколько дней на прошлой неделе пытался потратить лимиты на Fable (дошел до 43%, одновременно делая пару проектов), а за сегодня в стороннем клиенте на одном достаточно косметическом баге потратил 15%. https://lucumr.pocoo.org/2026/7/4/better-models-worse-tools/

Кратко (AI)

Армин Ронахер выявил, что новые модели Anthropic (Opus 4.8 и Sonnet 5) допускают ошибки при вызове инструментов, добавляя несуществующие поля в аргументы. Причиной стало обучение моделей в среде Claude Code, которая автоматически исправляет ошибки, из-за чего модели разучились строго следовать заданным схемам.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖