KVAE: Family of Tokenizers for Multimodal Generative Models Paper • 2608.05798 • Published 2 days ago • 14
Kandinsky WM 1.0 Collection Image-to-Video models for Physical AI: autonomous driving, robotics, general physics. • 3 items • Updated 4 days ago • 3
LeVo 2: Stable and Melodious Song Generation via Hierarchical Representation Modeling and Progressive Post-Training Paper • 2606.30642 • Published Jun 29 • 1
SGMD: Score Gradient Matching Distillation for Few-Step Video Diffusion Distillation Paper • 2605.30116 • Published May 28 • 4
SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation Paper • 2607.21553 • Published 16 days ago • 39
Xiaomi-Robotics-U0 Collection Unified embodied synthesis model that bridges foundation image generation and embodied world modeling • 2 items • Updated 26 days ago • 10