Reddit
Самый безопасный ИИ — тот, который не знает, чего мы хотим: интервью со Стюартом Расселом
Стюарт Рассел, профессор Калифорнийского университета в Беркли, обсуждает концепцию «доказуемо полезного ИИ», где безопасность обеспечивается отказом от жестко заданных целей в пользу постоянного обучения на человеческих предпочтениях. В подкасте анализируется эволюция систем от простых игровых программ до современных LLM и риски, возникающие при передаче ИИ фиксированных задач, когда его возможности превышают человеческие.
score 40r/artificial