FinanceComplexQA: Benchmarking Agentic Reasoning on Industrial-grade Financial Documents Paper • 2607.19238 • Published 13 days ago • 8
Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding Paper • 2604.26779 • Published Apr 29 • 15
SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning Paper • 2607.14777 • Published 18 days ago • 103
Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE Paper • 2607.07740 • Published 26 days ago • 24