Reddit
Существуют ли размеченные датасеты для оценки решений систем безопасности (guardrails)?
Автор делится опытом сравнения двух систем guardrails для LLM-агентов, которые противоречиво классифицировали одни и те же запросы. В результате выяснилось, что на рынке отсутствует общепринятый стандарт или размеченный датасет с ground truth для валидации таких решений, что затрудняет выбор между вендорами.
score 40r/AI_Agents