Reddit
Я обучил модель ошибаться в 98% случаев, будучи уверенной в этом на 96%: эксперимент с инверсией предсказаний
Автор обучил модель Qwen3.5-9B с использованием адаптера Nimble намеренно выбирать худшие ответы, достигнув точности ошибок в 98% при уверенности в них на 96%. Этот эксперимент служит контрольным примером для проверки систем автоматизации, которые полагаются на высокую уверенность модели, демонстрируя, что модель должна знать правильный ответ, чтобы надежно ошибаться.
score 40r/LocalLLaMA