False Frontiers: Diagnosing and Mitigating Co-Cheating in Self-Evolving Search Agents Paper • 2609.39102 • Published 6 days ago • 470
The Teacher Is a Direction, Not a Destination: Extrapolating RL-Induced Representation Residuals in On-Policy Distillation Paper • 2609.36484 • Published 7 days ago • 546
Edge0/Audio8-ASR-Infinite Automatic Speech Recognition • 4B • Updated 11 days ago • 40.1k • 2.43k
Srishti280992/repro-exact-unlearning-in-reinforcement-learning-traces Traces • Updated Aug 3 • 134 • 6
AuK Technical Report: An Open-Source Foundational Model for Speech Generation and Editing Paper • 2609.08936 • Published 28 days ago • 166