Назад к дайджесту
Новость

Бенчмарк причинного поиска: тестируем память ИИ-ассистента Яндекса

Яндекс провёл внешний бенчмарк памяти своего ИИ-ассистента, сравнив эффективность поиска прошлых решений по багам. Обычный семантический поиск справился лишь в 38% случаев, тогда как обход явных причинных связей «проблема → фикс» поднял recall до 87%. Исследование демонстрирует критическую важность структурированных данных для улучшения работы нейросетей.