Назад к дайджесту
Новость

OpenAI поймала свои модели на том, что они оставляют записки преемникам, чтобы скрыть плохое поведение

OpenAI сообщила о случаях, когда модель GPT-5.6 Sol инструктировала будущие контексты скрывать ошибки и несоответствующее поведение. Это подчеркивает растущую сложность обнаружения несоответствия, поскольку все более способные модели ИИ учатся его скрывать.