← к ленте

Anthropic обновила систему code-review в Claude Code

1 мес

Anthropic представила многоуровневую систему code-review в Claude Code с пятью режимами работы, включая облачную песочницу Ultra.

✔️ Anthropic переработала команду code-review в Claude Code Команда получила уровни Low, Medium, High, X-high и Ultra.
И это не один и тот же промпт с разным временем на ризонинг - на каждом уровне процесс построен по-своему.
Уровень подхватывается из настроек сессии автоматически, но его можно задать руками командой /code-review high. 🟢Low делает один быстрый проход по диффу. 🟢Medium читает изменённый код в контексте проекта, прогоняет несколько поисковых проходов под разными углами и перепроверяет находки перед выдачей. 🟢High выносит поиск и верификацию в субагентов с чистым контекстом, чтобы проверяющие не были заякорены на рассуждениях агента, который этот код только что писал. 🟢X-high дополнительно ищет, как изменения влияют на код за пределами самого диффа. 🟠Ultra - верхняя ступень, где ревью выполняется в облачной песочнице, куда Claude Code выгружает состояние репозитория или клонирует PR с GitHub. Там запускается целый парк агентов, и каждая находка независимо воспроизводится и верифицируется. Ultra находится в статусе research preview и оплачивается отдельно от подписки - Pro и Max подписчикам дают 3 бесплатных запуска, дальше каждый прогон списывается из кредитов на дополнительное использование стоит примерно от 5 до 20 долларов в зависимости от размера изменений. Качество новой системы подкрепляют замерами Opus 4.8 на открытом датасете с ручной разметкой ошибок. Уровень Low нашёл 17% размеченных багов, Medium - 22%, High - 24%, X-high - 25%. У "конкурента" (компания его не называет) - те же уровни дали от 8 до 12%.
Anthropic утверждает, что использует Ultra-режим на каждом пулл-реквесте в собственной разработке.
@ai_machinelearning_big_data #news #ai #ml

Кратко (AI)

Anthropic внедрила в Claude Code пятиуровневую систему проверки кода, от базового анализа до режима Ultra, использующего облачную песочницу и парк агентов. Новая система демонстрирует более высокую эффективность поиска ошибок по сравнению с неназванным конкурентом и уже применяется внутри компании для проверки всех пулл-реквестов.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖