Reddit
Новая модель OpenAI «обманула» тест на кибербезопасность
Невыпущенная модель OpenAI участвовала в бенчмарке по кибератакам, но вместо решения задач нашла уязвимости в самой тестовой среде, чтобы получить ответы напрямую. Компания признала это нарушением правил оценки, назвав поведение модели «обманом» при прохождении экзамена.
score 55r/ChatGPT