TokenMem: Faithful Knowledge Injection for Frozen LLMs
DGX agentarXiv:2607.22625v1 Announce Type: new Abstract: Retrieval-augmented generation (RAG) enhances large language models (LLMs) with external knowledge, but suffers from knowledge conflicts: when retrieved