← к ленте

Критика ARC-AGI как бенчмарка

L@lovedeathtransformersAI-инженер
1 нед

Критический взгляд на ARC-AGI и его роль в оценке способностей LLM.

Дискуссия о методах оценки интеллекта ИИ.

  • Вопрос о том, являются ли текущие бенчмарки объективными показателями прогресса ИИ.
  • Противостояние между сторонниками специализированных тестов на логику и разработчиками LLM.
Вообще arc agi это самый большой копиум, каждый год челы анонсят с лицом "ну вот теперь точно ллм не решат" какую то полную хуйню и каждый раз приходят рандомы и разносят
КонтекстAI
ARC-AGI (Abstraction and Reasoning Corpus) — это набор задач, созданный Франсуа Шолле для оценки способности ИИ к абстрактному мышлению и обобщению, которые считаются сложными для современных языковых моделей. Вокруг теста ведутся постоянные дискуссии о том, насколько он адекватно измеряет интеллект и могут ли LLM достичь высоких результатов с помощью специфических методов обучения.

Кратко (AI)

Автор поста выражает скептическое отношение к бенчмарку ARC-AGI. По мнению автора, заявления о неспособности LLM решить задачи этого теста регулярно опровергаются новыми результатами.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖