Reddit
Тонкая настройка против наследования поведения базовой модели: кейс с abliterated Qwen
Автор делится результатами LoRA-тонкой настройки поверх модифицированной базовой модели Qwen с удалённым механизмом отказа. Он обнаружил, что адаптер не добавляет и не убирает отказное поведение — оно полностью унаследовано от базы, что легко упустить при оценке только качества выполнения задачи. Улучшение по внутренним бенчмаркам оказалось статистически незначимым (p=0.5), а сравнение с Claude Sonnet 5 и Opus 5 показало неожиданные расхождения в ошибках галлюцинации.
score 55r/artificial