Критика ARC-AGI как бенчмарка
L@lovedeathtransformersAI-инженер
1 недКритический взгляд на ARC-AGI и его роль в оценке способностей LLM.
Дискуссия о методах оценки интеллекта ИИ.
- Вопрос о том, являются ли текущие бенчмарки объективными показателями прогресса ИИ.
- Противостояние между сторонниками специализированных тестов на логику и разработчиками LLM.
Вообще arc agi это самый большой копиум, каждый год челы анонсят с лицом "ну вот теперь точно ллм не решат" какую то полную хуйню и каждый раз приходят рандомы и разносят
КонтекстAI
ARC-AGI (Abstraction and Reasoning Corpus) — это набор задач, созданный Франсуа Шолле для оценки способности ИИ к абстрактному мышлению и обобщению, которые считаются сложными для современных языковых моделей. Вокруг теста ведутся постоянные дискуссии о том, насколько он адекватно измеряет интеллект и могут ли LLM достичь высоких результатов с помощью специфических методов обучения.
Кратко (AI)
Автор поста выражает скептическое отношение к бенчмарку ARC-AGI. По мнению автора, заявления о неспособности LLM решить задачи этого теста регулярно опровергаются новыми результатами.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖