Sakana AI выпустила Fugu-Ultra версии 1.1 — систему оркестрации агентов, которая распределяет задачи между несколькими frontier-моделями и объединяет их результаты в единый ответ. Первая версия вышла в открытый доступ месяц назад, и новое поколение уже превосходит конкурентов Fable и Sol по бенчмаркам, а также обгоняет Fable 5 везде, кроме SWEi.
Прирост качества достигнут не за счет повышения цены — тарифы остались прежними ($5/$30 за миллион input/output токенов), — а благодаря доступу к более свежим и способным моделям и улучшению самой модели, лежащей в основе логики вызова агентов.
1.1номер новой версии Fugu-Ultra
$5/$30цена за млн input/output токенов
+7,9 пунктаприрост качества относительно v1.0
- По данным Sakana AI, прирост качества относительно v1.0 достигает 7,9 пункта на опубликованных бенчмарках
- Наиболее заметные улучшения заявлены на ProgramBench и Terminal Benchi 2.1 — задачах на кодинг и длительную автономную работу агента
- Архитектура Fugu основана на исследованиях TRINITY и Conductor
- Система работает через единый API, но под ним скрывается пул из нескольких моделей: Fugu сама выбирает экспертов, распределяет между ними роли и объединяет результаты
- Fugu-Ultra 1.1 превосходит Fable и Sol по бенчмаркам и обгоняет Fable 5 во всех тестах, кроме SWE
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖