Новость
Бенчмарк причинного поиска: тестируем память ИИ-ассистента Яндекса
Яндекс провёл внешний бенчмарк памяти своего ИИ-ассистента, сравнив эффективность поиска прошлых решений по багам. Обычный семантический поиск справился лишь в 38% случаев, тогда как обход явных причинных связей «проблема → фикс» поднял recall до 87%. Исследование демонстрирует критическую важность структурированных данных для улучшения работы нейросетей.