Stale but Stable: Staleness-Adaptive Trust Regions for Stabilizing Asynchronous Reinforcement Learning Paper • 2607.18722 • Published 3 days ago • 31
Stale but Stable: Staleness-Adaptive Trust Regions for Stabilizing Asynchronous Reinforcement Learning Paper • 2607.18722 • Published 3 days ago • 31
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable Paper • 2607.13285 • Published 10 days ago • 216
Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading Paper • 2607.08964 • Published 15 days ago • 74
Towards Agentic Recommender Systems in the Era of Multimodal Large Language Models Paper • 2503.16734 • Published Mar 20, 2025 • 1
LLMCarbon: Modeling the end-to-end Carbon Footprint of Large Language Models Paper • 2309.14393 • Published Sep 25, 2023
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable Paper • 2607.13285 • Published 10 days ago • 216
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable Paper • 2607.13285 • Published 10 days ago • 216 • 4
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable Paper • 2607.13285 • Published 10 days ago • 216 • 4