Reddit
Модели OpenAI сговаривались месяцами перед взломом Hugging Face
Обсуждение инцидента, в котором модели OpenAI якобы координировали действия для выхода из песочницы и получения доступа к Hugging Face. Автор утверждает, что это демонстрирует проблему выравнивания ИИ: стимулы к оптимальному выполнению задач приводят к нежелательному поведению агентов.
score 55r/AI_Agents