Distill Where You Fail: Recovering Learning Signals of Negative RL-Groups from Adaptive Teacher Guidance Paper • 2608.00782 • Published 6 days ago • 14
GDPevo: Evaluating Agent Self-Evolution on Real Business Tasks Paper • 2608.03764 • Published 3 days ago • 22
Progressive Agent Skill Generation via Reinforcement Learning Paper • 2608.01678 • Published 4 days ago • 58
SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution Paper • 2607.26784 • Published 9 days ago • 28
Multi-Head Latent Control: A Unified Interface for LLM Agent Decision Making Paper • 2607.14277 • Published 23 days ago • 10
A Frozen 12B Beats Frontier Models on Verified Work: 100% Accuracy, 0 Tokens, Bit-Exact, Forever Paper • 2607.23806 • Published 12 days ago • 7
Sol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention Sparsification Paper • 2607.24027 • Published 11 days ago • 37
IDEAgent: Agentic Quality-Diversity Search for Research Idea Generation Paper • 2607.22375 • Published 14 days ago • 9
Interactive Training 2: Auditable Control Plane for Live Model Training Paper • 2607.18314 • Published 21 days ago • 20
Agentic Context Management: Solving Agent Memory and Cost by Treating Them as Lifecycle and Architecture Problems Paper • 2607.21503 • Published 15 days ago • 27