view article Article Native-speed vLLM transformers modeling backend hmellor, lysandre • 19 days ago • 59
OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers Paper • 2607.02461 • Published 25 days ago • 40
view article Article Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel nvidia • Jun 24 • 37
view article Article Unlocking asynchronicity in continuous batching +1 ror, pcuenq, ariG23498 • May 14 • 65
view article Article Mixture of Experts (MoEs) in Transformers +5 ariG23498, pcuenq, merve, IlyasMoutawwakil, ArthurZ, sergiopaniego, Molbap • Feb 26 • 173
Running on CPU Upgrade Featured 3.25k The Smol Training Playbook 📚 3.25k The secrets to building world-class LLMs
Running 118 Unlocking On-Policy Distillation for Any Model Family 📝 118 Explore on-policy distillation visualization for any model
view article Article Efficient MultiModal Data Pipeline +3 ariG23498, lusxvr, andito, sergiopaniego, pcuenq • Jul 8, 2025 • 73