Beyond Relevance-Centric Retrieval: Rubric-Oriented Document Set Selection and Ranking Paper • 2607.19747 • Published 5 days ago • 28
K12-KGraph: A Curriculum-Aligned Knowledge Graph for Benchmarking and Training Educational LLMs Paper • 2605.09635 • Published 4 days ago • 56
OpenForgeRL: Train Harness-native Agents in Any Environment Paper • 2607.21557 • Published 4 days ago • 5
SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation Paper • 2607.21553 • Published 4 days ago • 26
Show, Don't Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text Paper • 2607.21072 • Published 4 days ago • 35
ReferTrack: Referring Then Tracking for Embodied Visual Tracking Paper • 2607.20061 • Published 5 days ago • 49
GraphVid: Interactive Graph-Controllable Video Generation Paper • 2607.21580 • Published 4 days ago • 3
Tencent WorkBuddy Bench: A Multi-Domain Coding-Agent Benchmark with Contamination-Resistant Task Construction Paper • 2607.20911 • Published 4 days ago • 20
AREX: Towards a Recursively Self-Improving Agent for Deep Research Paper • 2607.21461 • Published 4 days ago • 136
NVIDIA-labs OO Agents: Native Python Object-Oriented Agents Paper • 2607.20709 • Published 5 days ago • 25
DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations Paper • 2607.19865 • Published 5 days ago • 8
SWE-Pruner Pro: The Coder LLM Already Knows What to Prune Paper • 2607.18213 • Published 7 days ago • 76
Generalizable VLA Finetuning via Representation Anchoring and Language-Action Alignment Paper • 2607.13429 • Published 12 days ago • 14
Masked Diffusion Language Models are Strong and Steerable Text-Based World Models for Agentic RL Paper • 2607.16204 • Published May 7 • 7
LLM-as-a-Coach: Experiential Learning for Non-Verifiable Tasks Paper • 2607.18110 • Published 7 days ago • 14
AgentDebugX: An Open-Source Toolkit for Failure Observability, Attribution, and Recovery in LLM Agents Paper • 2607.18754 • Published 6 days ago • 24
TimeLens2: Generalist Video Temporal Grounding with Multimodal LLMs Paper • 2607.17423 • Published 8 days ago • 165