Сравнение надежности моделей Fable и Opus в работе агентов
С@senior_augurAI-инженер
1 месПользователь делится опытом использования модели Fable, отмечая её высокую надежность и проактивность в работе по сравнению с Opus.
Вот и подходят к концу обе мои квоты на Fable (личная и корпоративная).
Отличная ли это модель? Да 👍
Как когда-то GPT-4 значительно повысил надёжность языковых моделей, Fable значительно повысила надёжность агентов.
В случае Опуса я предполагал по умолчанию, что я не доверяю выхлопу модели. На все нетривиальные изменения прогонял simplify, review, codex:adrversarial-review, qudo и отсматривал результат глазами. Потому что много раз меня Опус подводил, как в макро, так и в микро-решениях.
В случае Fable я по привычке это тоже сначала делал, но пользы от этого было уже не так много. Предположение по умолчанию поменялось.
Более того, Fable регулярно делала что-то сверх того, о чём я её просил. Например, когда она составляла отчёт в виде HTML странички, она установила playwright, headless chromium, сделал итоговый скриншот странички, загрузила его на закрытый корпоративный paste, чтобы я мог посмотреть на дизайн глазами до развёртывания. Мог ли такое сделать Опус? Мог конечно, но только если бы я описал весь путь. А я даже не знал, что я такое хочу!😜
Означает ли это, что Fable не ошибался? Лол, конечно ошибался, и тоже и в макро, и в микро. Но вот количество ошибок было гораздо меньше, и исправлять их было проще.
Кратко (AI)
Автор сравнивает работу моделей Fable и Opus, отмечая, что Fable демонстрирует более высокую надежность при выполнении агентских задач. Модель Fable способна к проактивным действиям, таким как автоматическая установка инструментов и визуализация результатов, что значительно упрощает рабочий процесс.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖