Назад к дайджесту
Reddit

Безопасность и согласованность в эпоху моделей с долгосрочным горизонтом

Обсуждение проблем безопасности и выравнивания (alignment) нейросетей, способных действовать в долгосрочной перспективе. Поднимает вопросы контроля над агентами, работающими на протяжённых временных интервалах, и риски накопления ошибок.

score 40r/OpenAI