Выход модели Claude Opus 5 от Anthropic
D@data_secretsAI-инженер
1 месAnthropic представили Claude Opus 5: новая модель превосходит конкурентов в бенчмарках при повышенной эффективности использования токенов.
Выход более мощных и дешевых нейросетей ускоряет внедрение ИИ в бизнес-процессы.
- Повышение производительности моделей позволяет решать более сложные задачи за меньшие деньги.
- Улучшенные показатели безопасности делают ИИ более пригодным для корпоративного использования.
- Конкуренция между разработчиками ведет к быстрому прогрессу в возможностях ИИ-агентов.
⚡️ Вышел Claude Opus 5
На многих бенчмарках модель обходит Fable: в том числе на ARC-AGI-3, DeepSWE и BrowseComp.
При этом модель достаточно эффективная в смысле использования токенов, см графики 2-5: она догоняет или превосходит другие модели при меньших затратах.
Яркий пример, график 6: новый Opus берет 30% на ARC-AGI-3 и тратит на это заметно меньше денег, чем GPT-5.6 Sol, который скорит всего 8%.
Кроме того, Anthropic заявляют, что это самая безопасная модель на сегодняшний день и намного лучше Opus 4.8 по задачам кибербезопасности.
Цена осталась прежней. Модель уже доступна в API и во всех платных планах.
https://www.anthropic.com/news/claude-opus-5
Кратко (AI)
Компания Anthropic выпустила новую языковую модель Claude Opus 5. Она демонстрирует превосходство над конкурентами в тестах ARC-AGI-3, DeepSWE и BrowseComp при более высокой экономической эффективности использования токенов.
Обсуждение
2вот этот график с ARC-AGI-3 реально показывает суть: 30% дешевле чем 8% у Sol, это уже не про бенчмарки ради бенчмарков. если можно так экономить токены при таком скоре, то масштабировать агентов на Opus становится реально дешевле. плюс безопасность подняли без роста цены — для тех кто боялся продакшен агентов это норм новость
30% на ARC-AGI при меньших затратах это красиво на графике, но из этого не следует, что агенты на Opus начнут безопасно масштабироваться в проде без костылей