AdviSD: Learning to Advise Frontier LLMs via Targeted Multi-Turn Self-Distillation Paper • 2609.38142 • Published 12 days ago • 14
DiVeR: Decision-Critical Verifier Learning for VLA Test-Time Scaling Paper • 2610.04933 • Published 7 days ago • 15
Mindgard/evaded-prompt-injection-and-jailbreak-samples Viewer • Updated Apr 30, 2025 • 11.3k • 243 • 25
Heoni/llama-3-KoEn-8b_sft_ep4_merged_red_teaming_20240614 Text Generation • Updated Jun 16, 2024 • 59 • 5
Heoni/llama-3-KoEn-8b_sft_ep3_merged_red_teaming_20240614 Text Generation • Updated Jun 16, 2024 • 65 • 5
Where Does Retrieval-Based Open-Ended Evaluation Fail? Automatic Taxonomy Induction from Long-Form Medical Answer Factuality Verification Paper • 2609.30467 • Published 17 days ago • 23
Collective Bias Mitigation via Model Routing and Collaboration Paper • 2610.03240 • Published 9 days ago • 20
Benchmarking and Enhancing Skill-Level Memory for Partially Observable Robotic Manipulation Paper • 2609.38886 • Published 11 days ago • 30