Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published 2 days ago • 223
PaperGym: Rubric-Centered Evolution for Research-Plan Generation Paper • 2608.31119 • Published 5 days ago • 38
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning Paper • 2608.05987 • Published about 1 month ago • 101
CreativeBench: Benchmarking and Enhancing Machine Creativity via Self-Evolving Challenges Paper • 2603.11863 • Published Mar 12 • 8