Reddit
Языковые модели сегодня: ранжирование по человеческим предпочтениям
Обсуждается влияние систем ранжирования на основе человеческих предпочтений (как Chatbot Arena) на поведение LLM, включая тенденцию к избыточному форматированию для создания впечатления беглости. Институт Макса Планка запустил исследовательскую платформу Comparity AI для бесплатного сравнения фронтальных моделей с персональным лидербордом.
score 40r/MachineLearning