SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution Paper • 2607.26784 • Published 3 days ago • 25
CAST: Game Solvers as Turn-Level Teachers for LLM Agents Paper • 2607.25308 • Published 4 days ago • 36
MineExplorer: Evaluating Open-World Exploration of MLLM Agents in Minecraft Paper • 2605.30931 • Published May 29 • 12
V_{0.5}: Generalist Value Model as a Prior for Sparse RL Rollouts Paper • 2603.10848 • Published Mar 11 • 17
MemOCR: Layout-Aware Visual Memory for Efficient Long-Horizon Reasoning Paper • 2601.21468 • Published Jan 29 • 25
Look Back to Reason Forward: Revisitable Memory for Long-Context LLM Agents Paper • 2509.23040 • Published Sep 27, 2025 • 12
CoBA-RL: Capability-Oriented Budget Allocation for Reinforcement Learning in LLMs Paper • 2602.03048 • Published Feb 3 • 32
view article Article M2.1: Multilingual and Multi-Task Coding with Strong Generalization MiniMaxAI • Jan 5 • 41