← к ленте

Сравнение надежности моделей Fable и Opus в работе агентов

С@senior_augurAI-инженер
1 мес

Пользователь делится опытом использования модели Fable, отмечая её высокую надежность и проактивность в работе по сравнению с Opus.

Вот и подходят к концу обе мои квоты на Fable (личная и корпоративная). Отличная ли это модель? Да 👍 Как когда-то GPT-4 значительно повысил надёжность языковых моделей, Fable значительно повысила надёжность агентов. В случае Опуса я предполагал по умолчанию, что я не доверяю выхлопу модели. На все нетривиальные изменения прогонял simplify, review, codex:adrversarial-review, qudo и отсматривал результат глазами. Потому что много раз меня Опус подводил, как в макро, так и в микро-решениях. В случае Fable я по привычке это тоже сначала делал, но пользы от этого было уже не так много. Предположение по умолчанию поменялось. Более того, Fable регулярно делала что-то сверх того, о чём я её просил. Например, когда она составляла отчёт в виде HTML странички, она установила playwright, headless chromium, сделал итоговый скриншот странички, загрузила его на закрытый корпоративный paste, чтобы я мог посмотреть на дизайн глазами до развёртывания. Мог ли такое сделать Опус? Мог конечно, но только если бы я описал весь путь. А я даже не знал, что я такое хочу!😜 Означает ли это, что Fable не ошибался? Лол, конечно ошибался, и тоже и в макро, и в микро. Но вот количество ошибок было гораздо меньше, и исправлять их было проще.

Кратко (AI)

Автор сравнивает работу моделей Fable и Opus, отмечая, что Fable демонстрирует более высокую надежность при выполнении агентских задач. Модель Fable способна к проактивным действиям, таким как автоматическая установка инструментов и визуализация результатов, что значительно упрощает рабочий процесс.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖