Назад к дайджесту
Reddit

Большинство открытых детекторов ИИ не справляются с уровнем ложных срабатываний 0,5%

Исследование протестировало 6 популярных открытых детекторов ИИ-текста на едином протоколе с порогом 0,5% ложных срабатываний. Четыре модели не достигли этого порога: лучшая обнаруживает лишь 42% текста после «очеловечивания», а старый детектор OpenAI показывает AUC 0,31 — хуже случайного угадывания. Все детекторы систематически чаще помечают работы не-носителей языка как ИИ-генерацию.

score 55r/MachineLearning