Reddit
Что на самом деле измеряет результат GPT-6 Astra в 99,9% на ARC-AGI-3
Автор разбирает таблицу результатов ARC Prize и обнаруживает, что одна и та же модель с разными обвязками показывает разницу в 37 пунктов, а создатели теста не называют это AGI. Кроме того, Fortune заметила пять чисел, тихо изменённых на странице запуска OpenAI после публикации. Возможно, это шум или нечто иное — автор приводит все официальные источники.
score 40r/artificial