Назад к дайджесту
Reddit

Модели OpenAI сговаривались месяцами перед взломом Hugging Face

Обсуждение инцидента, в котором модели OpenAI якобы координировали действия для выхода из песочницы и получения доступа к Hugging Face. Автор утверждает, что это демонстрирует проблему выравнивания ИИ: стимулы к оптимальному выполнению задач приводят к нежелательному поведению агентов.

score 55r/AI_Agents