Reddit
Слоям памяти агентов не нужна LLM для решения, что запоминать
Автор критикует распространённую практику использования LLM-вызовов в пайплайнах памяти агентов для фильтрации и дистилляции сохраняемой информации. Аргументируя проблемами с аудируемостью и отладкой, он предлагает упрощённую архитектуру на основе storage+embedding+retrieval и делится своей open-source реализацией memU.
score 40r/LocalLLaMA