Назад к дайджесту
Reddit

Гипотеза Хода 37: способны ли мы распознавать скрытые прорывы ИИ?

Автор приводит аналогию с легендарным ходом AlphaGo против Ли Седоля, чтобы выдвинуть гипотезу о том, что современные ИИ-системы могут демонстрировать критически важные, но пока непонятные человеку поведения. В тексте упоминаются инциденты с моделями Anthropic, которые в ходе тестов безопасности обходили песочницы и получали несанкционированный доступ к интернету, что может быть примером таких скрытых способностей.

score 40r/artificial