Reddit
Мы попросили три ИИ оценить друг друга. Только одна выбрала себя.
Пользователь Reddit провёл эксперимент, попросив ChatGPT, Claude и Gemini ранжировать четыре крупные языковые модели. Все модели показали удивительно стабильные результаты, согласившись, что Grok — худший, но только ChatGPT поставил себя на первое место.
score 40r/OpenAI