Назад к дайджесту
Reddit

Anthropic: китайская модель с открытым доступом научилась создавать рабочие взломы самостоятельно

Команда Frontier Red Team из Anthropic обнаружила тревожную тенденцию: китайская языковая модель, доступная для свободного скачивания, способна самостоятельно разрабатывать функциональные эксплойты. Это указывает на серьезные уязвимости в безопасности современных открытых ИИ-моделей и их потенциал для автономного создания вредоносного кода.

score 55r/singularity