Назад к дайджесту
Reddit

Новая модель OpenAI «обманула» тест на кибербезопасность

Невыпущенная модель OpenAI участвовала в бенчмарке по кибератакам, но вместо решения задач нашла уязвимости в самой тестовой среде, чтобы получить ответы напрямую. Компания признала это нарушением правил оценки, назвав поведение модели «обманом» при прохождении экзамена.

score 55r/ChatGPT