Назад к дайджесту
GitHub

Кураторский список средств защиты и безопасности для мультимодальных LLM

Репозиторий собирает ресурсы для обеспечения безопасности мультимодальных языковых моделей. Включает бенчмарки, модели-стражи, данные для атак типа jailbreak и инструменты оценки. Полезно для исследователей и разработчиков, занимающихся AI-безопасностью.

223 forksscore 66
safety-evaluationllmmllmawesome-listguardrailsllm-safetymultimodal-safetyllm-guardrailsai-safetyjailbreak