Новость
Заставьте AI-агента доказать, что его тесты можно провалить
Статья описывает проблему, когда ИИ-агент пишет код и тесты с одинаковыми ошибками, из-за чего тесты проходят ложно. Предлагается подход, при котором агент должен сам доказать, что написанные им тесты не являются надежными и могут быть пройдены неверно.