AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning Paper • 2608.05987 • Published 9 days ago • 94
CAST: Game Solvers as Turn-Level Teachers for LLM Agents Paper • 2607.25308 • Published 18 days ago • 41
MeKi: Memory-based Expert Knowledge Injection for Efficient LLM Scaling Paper • 2602.03359 • Published Feb 3 • 10