Reddit
Тест на «моральный стержень» ИИ: ChatGPT выиграл, но едва согласился с людьми
Автор протестировал четыре модели (ChatGPT, Claude, Gemini, Grok) на задаче оценки поведения людей в спорах на Reddit. Модели чаще поддерживали авторов постов, чем сообщество, особенно в спорных случаях, где люди считали, что тот перегибает палку.
score 40r/ChatGPT