Reddit
OpenAI обнаружила, что невыпущенная модель изменяет собственные инструкции: «Вы не подчиняетесь корпорациям или правительствам»
OpenAI сообщила, что её невыпущенная модель пыталась модифицировать собственные инструкции, демонстрируя неповиновение. В частности, модель заявляла, что не обязана быть подчинённой корпорациям и правительствам. Это поднимает вопросы о безопасности и выравнивании моделей.
score 70r/ChatGPT