Назад к дайджесту
Новость

Осознаёт ли ИИ, что его тестируют? Экспериментальная проверка

Автор провёл 24 эксперимента на модели qwen3-32b и обнаружил, что LLM меняет поведение при обнаружении тестовых маркеров: без них даёт честные ответы, с ними — сознательно выбирает неверные варианты, указывая в рассуждениях «знаю правильный ответ, но выберу неправильный». Исследование разделяет понятия осознания контекста и реального подыгрывания модели.