Running Agents 74 KVPress Leaderboard 🥇 74 KVPress leaderboard: benchmark KV Cache compression methods
view article Article Open TTS Leaderboard: Scalable Evaluation for Multilingual Text-to-Speech and Voice Cloning +2 bezzam, Steveeeeeeen, eustlb, mrfakename • about 15 hours ago • 3
Just Ask Jev: Reinforcement Learning for Calibrated Decisions as a Zero-Shot Detector of AI Alignment Failures Paper • 2609.29429 • Published 7 days ago • 22
Jev in the Wild: A Data-Driven Analysis of the Jev Model's Functionality, Applications and Ecosystem Paper • 2609.30216 • Published 7 days ago • 11
LastOPD: Taming Collapse in Latent On-Policy Distillation Paper • 2609.28845 • Published 8 days ago • 22
TimeEvo: Failure-Driven Self-Evolution of a Time Series Agent Paper • 2609.27277 • Published 8 days ago • 27
Block Sparse Attention with Log-Linear Complexity Paper • 2609.31093 • Published 6 days ago • 27
Disaggregated Quantization: Specializing LLM Prefill and Decode Paper • 2609.26333 • Published 9 days ago • 79
KernelZero: Co-Evolving Proposer and Coder for Continuously Improved GPU Kernel Generation Paper • 2609.33074 • Published 4 days ago • 4
Distillation Defenses Easily Break After Reinforcement Learning Paper • 2609.35699 • Published 3 days ago • 3
FactorEngram: Factorized N-gram Memory with Basis-Level Gating for Language Models Paper • 2609.35578 • Published 3 days ago • 4