Reddit
Opus 5.5 превзошла профессиональный человеческий уровень на бенчмарке, проверяющем способность ИИ писать полноценные сценарии с правильным голосом, содержанием, темпом, крючками и минимальным количеством ИИ-мусора
Модель Opus 5.5 достигла результата выше профессионального человеческого базового уровня на бенчмарке, оценивающем умение ИИ создавать полные сценарии с правильным голосом, содержанием, темпом и крючками, а также минимизировать типичные признаки ИИ-генерации. Это указывает на значительный прогресс в творческих задачах.
score 40r/singularity