Reddit
Исследователи обнаружили странную одержимость языковых моделей: Япония всегда на первом месте
Учёные из Кардиффского университета и HiTZ проанализировали 31 680 запросов к GPT, Gemini и Claude, обнаружив системную предвзятость. В отличие от базовых моделей, после инструктивного дообучения нейросети начинают массово ассоциировать культурные темы с Японией, выбирая её как «безопасный» и узнаваемый вариант. Исследование показывает, что эта смещённость возникает на этапе человеческой настройки, а не в исходных данных.
score 55r/ChatGPT