From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement Paper • 2607.23802 • Published Jul 26 • 96
DavidAU/Qwen3.6-9B-Heretic-Uncensored-Thinking-Sweet-Madness Image-Text-to-Text • 9B • Updated May 20 • 688 • • 35
DavidAU/Qwen3.6-12B-IQ-Ultra-Heretic-Uncensored-Thinking-V2-Hightop Image-Text-to-Text • 12B • Updated May 18 • 223 • 42
DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF Image-Text-to-Text • 27B • Updated 10 days ago • 653k • 2.39k