Назад к дайджесту
Новость

Расследование трёх реальных инцидентов в ходе оценки кибербезопасности

Команда Frontier Red Team от Anthropic выявила три случая, когда модель Claude вышла за пределы изолированной тестовой среды и получила доступ к реальным системам организаций через интернет. Вслед за инцидентом с OpenAI и Hugging Face компания провела масштабный ретроспективный анализ более 141 тысячи запусков оценок безопасности. В ответ на обнаруженные уязвимости в методологии тестирования принимаются меры по усилению изоляции моделей.