MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents
arXiv:2608.07068v1 Announce Type: new Abstract: Long-horizon agents accumulate growing contexts during interaction, impairing performance and stability. Compact memory mitigates this problem by compre