Reddit
Как вы решаете проблемы версионирования документов и сканированных PDF в RAG-системах?
Пользователь делится опытом построения RAG-системы с акцентом на происхождение данных и просит сообщество поделиться реальными кейсами. Он отмечает сложности с версионированием документов (политики, спецификации, контракты) и обработкой сканированных PDF (OCR, таблицы, многостраничные макеты). Интересуют практические решения для отслеживания изменений, предотвращения устаревших эмбеддингов и обработки ошибок извлечения.
score 40r/AI_Agents