Назад к дайджесту
Новость

Безопасность для кого? Отказ от правильного подмножества темы, а не всей темы

Статья рассматривает проблему избирательного отказа языковых моделей: вместо полного блокирования темы модель должна уметь отказывать только в опасных подмножествах запросов. Предлагается подход, который повышает точность безопасности, не ограничивая полезные сценарии использования.