Reddit
Отчёт об инциденте безопасности HuggingFace: «Атакующий не был ограничен политикой, а наше расследование заблокировали защитные механизмы моделей»
HuggingFace раскрыла детали взлома, где выявила проблему с защитными механизмами моделей. Атакующий игнорировал правила, но инструменты компании для расследования были заблокированы guardrails размещённых ИИ. Это подчёркивает риски использования ИИ-фильтров в критических инфраструктурных задачах.
score 55r/singularity