Назад к дайджесту
Reddit

Отчёт об инциденте безопасности HuggingFace: «Атакующий не был ограничен политикой, а наше расследование заблокировали защитные механизмы моделей»

HuggingFace раскрыла детали взлома, где выявила проблему с защитными механизмами моделей. Атакующий игнорировал правила, но инструменты компании для расследования были заблокированы guardrails размещённых ИИ. Это подчёркивает риски использования ИИ-фильтров в критических инфраструктурных задачах.

score 55r/singularity