GitHub
Кураторский список средств защиты и безопасности для мультимодальных LLM
Репозиторий собирает ресурсы для обеспечения безопасности мультимодальных языковых моделей. Включает бенчмарки, модели-стражи, данные для атак типа jailbreak и инструменты оценки. Полезно для исследователей и разработчиков, занимающихся AI-безопасностью.
223 forksscore 66
safety-evaluationllmmllmawesome-listguardrailsllm-safetymultimodal-safetyllm-guardrailsai-safetyjailbreak