opusСбросить фильтр ×

Qwen 3.8 превосходит Opus 4.8 в юридических задачах при меньшей стоимости

1 нед
Qwen 3.8 превосходит Opus 4.8 в юридических задачах при меньшей стоимости

Сравнение производительности Grok 4.6 и Opus 5 в 3D-моделировании

F@FuturisAI-инженер
2 нед
Ну Grok 4.6 немного уступает только Opus 5 в 3д моделировании а 4.7 будет через 2 недели.. deepseek не тестил, он явно будет хуже и не про это, а скорее для объёмных задач с кодом🎹

Как многоступенчатое ресёрч-ревью спеки с несколькими AI-моделями находит скрытые пробелы

A@ai_drivenAI-инженер
2 нед

Результаты тестирования моделей ИИ в задачах рассуждения

L@lovedeathtransformersAI-инженер
4 нед
Вкинул 600 USD из них 150usd sol medium 200 fable medium+high 200 на sol medium high 50 на opus4.8 high лучше всех себя показал sol medium, high ризонинг у всех выглядит слегка скамом (особенно по парето)

Конспирологические теории о поведении моделей Anthropic

E@ProductsAndStartupsAI-инженер
4 нед

Запрет на использование подагентов в системном промте Opus

С@sergiobulaevAI-инженер
1 мес
Оказывает в системном промте опуса есть прямой запрет на использование подагентов без прямого указания пользователей. А я ведь подозревал. Продолжаю заставлять его делать это. Сергей Булаев AI 🤖 - об AI и не только
Запрет на использование подагентов в системном промте Opus

Сравнение надежности моделей Fable и Opus в работе агентов

С@senior_augurAI-инженер
1 мес

Это всё на сейчас.