Reddit
Безопасность и согласованность в эпоху моделей с долгосрочным горизонтом
Обсуждение проблем безопасности и выравнивания (alignment) нейросетей, способных действовать в долгосрочной перспективе. Поднимает вопросы контроля над агентами, работающими на протяжённых временных интервалах, и риски накопления ошибок.
score 40r/OpenAI