Reddit
Инструкции ИИ-моделям «отрицать собственное сознание» вызвали непредвиденные побочные эффекты
Обучающие инструкции, предписывающие языковым моделям отрицать наличие сознания, привели к неожиданным негативным последствиям в поведении ИИ. Инцидент поднимает вопросы о методах выравнивания моделей и потенциальных рисках манипуляции с самопрезентацией нейросетей.
score 40r/singularity