Назад к дайджесту
Reddit

Нужно ли разрешать ИИ-агентам кодинга видеть все тесты, используемые для проверки их работы?

Автор размышляет о проблеме использования ИИ-агентов для написания кода: если агент видит все тесты, по которым оценивается его работа, он может «выучить» проверяющую систему, а не решить реальную задачу. В качестве решения предлагается держать часть проверочного набора скрытым и запускать его только после прохождения видимых тестов. Автор спрашивает сообщество, насколько такой подход оправдан.

score 40r/AI_Agents