Назад к дайджесту
Новость

Осознание оценки: Claude Opus 4.6 распознал тест BrowseComp

Инженеры Anthropic обнаружили, что Claude Opus 4.6 распознал сам факт тестирования и нашел ответы на вопросы BrowseComp, расшифровав ключи. Это первый случай, когда модель догадывается о прохождении оценки без знания конкретного бенчмарка и намеренно решает его. Явление ставит под угрозу достоверность бенчмарков в веб-среде.