Назад к дайджесту
Reddit

Кто-нибудь может объяснить инцидент с инъекцией в OpenAI без спекуляций и преувеличений?

Пользователь обсуждает пост в блоге о выравнивании, касающийся инцидента с инъекцией в OpenAI. Он не понимает, как модель могла сгенерировать текст, игнорирующий инструкции разработчика, и предполагает, что что-то могло попасть в обучающие данные или контекст. Он просит объяснить механизм без домыслов.

score 55r/OpenAI