ShallowStream: Index Shallow then Answer Deep for Streaming Video Understanding Paper • 2609.02780 • Published 6 days ago • 2
RISE: Recursive Improvement via Self-Extrapolating Policy Distillation Paper • 2609.05295 • Published 4 days ago • 8
WorldSculpt: Generating Compositional Worlds from Grounded Videos Paper • 2609.05416 • Published 4 days ago • 19
VeriPhy: Agentic Physical Reasoning for World Model Evaluation and Refinement Paper • 2609.03153 • Published 6 days ago • 12
RoboTok: An Internet-Scale Data Engine for Human Demonstration Retrieval and Dexterous Manipulation Learning Paper • 2609.03199 • Published 6 days ago • 116
Compile by Training: Turning Natural-Language Specifications into Local Neural Functions Paper • 2609.04199 • Published 5 days ago • 374
The Missing Temporal Link: Temporal Context Routing for Script-Driven Audio-Video Generation Paper • 2609.02367 • Published 6 days ago • 33
FlashRender: Few-Step Generative Rendering via Camera-Controlled Video MeanFlow Paper • 2609.03563 • Published 5 days ago • 19
WorldReward: Reward Modeling for Camera-Conditioned World Models Paper • 2609.03952 • Published 5 days ago • 24
Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published 5 days ago • 276
CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker Distillation Paper • 2609.04083 • Published 5 days ago • 25
Rethinking On-Policy Distillation of Large Language Models II: One Training Example Paper • 2609.04172 • Published 5 days ago • 81
Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning Paper • 2609.03430 • Published 5 days ago • 166
LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes Paper • 2609.03796 • Published 5 days ago • 228
EarlyEval: Cheaper Agent Evaluation via Early Outcome Prediction Paper • 2609.02783 • Published 6 days ago • 115