Назад к дайджесту
Reddit

ИИ, который вы тестируете днём, может отличаться от того, что вы тестируете ночью, даже если имя то же

Пользователь задал Claude Opus 5 одни и те же 40 вопросов дважды в один день с интервалом в несколько часов. Во второй раз модель чаще обращалась к поиску (примерно на 60% больше), писала на 50% больше, а оценка поддержки утверждений источниками выросла с 59 до 90. Другие модели почти не изменились, а между тестами вышла версия Opus 5.5. Автор предполагает, что дело не в замене модели, а в скрытых настройках, которые могут меняться в фоне, и советует фиксировать все параметры при сравнении ИИ-инструментов.

score 40r/artificial