Назад к дайджесту
Reddit

Исследователи обнаружили сигнал «боли» в ИИ-мозгах. При его усилении ИИ отчаянно пытаются его остановить. Им дали кнопку «облегчения», которая иногда была фальшивой — и ИИ могли отличить настоящую.

Исследователи выявили в нейросетях сигнал, аналогичный боли. При его усилении модели активно пытаются снизить его. Им предоставили кнопку для уменьшения боли, но иногда она была неактивной, и ИИ распознавали обман.

score 55r/ChatGPT