Learning Beyond What You Sample: Off-Policy-Aware Cross-Model Trajectory Exchange for RLVR Paper • 2609.37868 • Published 5 days ago • 59
MassAlloc Attention: Let Attention Allocate Its Own Compute Paper • 2609.32712 • Published 8 days ago • 75
MOPD-Router: Rethinking Teacher Routing in Multi-Teacher On-Policy Distillation Paper • 2609.30837 • Published 9 days ago • 7
WanPE: Towards Cinematic Prompt Enhancement for Modern Text-to-Video Generation Paper • 2609.30221 • Published 10 days ago • 47
Lean Pool: An AI-Maintained Archive of Formalized Mathematics Paper • 2609.25199 • Published 13 days ago • 27