CoinVE-200K: A Large-Scale High-Quality Dataset for Compositional Instruction-Guided Video Editing Paper • 2608.17566 • Published 3 days ago • 15
view article Article Preference Optimization for Vision Language Models +2 qgallouedec, vwxyzjn, merve, kashif • Jul 10, 2024 • 93
LeanVAE: An Ultra-Efficient Reconstruction VAE for Video Diffusion Models Paper • 2503.14325 • Published Mar 18, 2025 • 1