Назад к дайджесту
Новость

Безопасность и согласованность в эпоху долгосрочных моделей

OpenAI делится опытом внедрения моделей, работающих в длительном режиме, выделяя новые риски безопасности и наблюдаемые сбои. Компания описывает, как итеративное развертывание помогло улучшить механизмы защиты и выравнивания.