EVOKE: Eliciting World Knowledge in Agents for Transferable Decision-Making Paper • 2609.38334 • Published 6 days ago • 79
SkillGym: Training Skill-Use Agents with Automatic Verifiable Environment Generation Paper • 2609.37539 • Published 8 days ago • 11
AREX-2: Advancing Self-Improving Agents through Long-Horizon Reflective Tasks Paper • 2609.38288 • Published 8 days ago • 140
More Choices, Fewer Decisions: Ordinal-Scale Bias in JEV-like Direct-Decision Models Paper • 2609.38827 • Published 7 days ago • 60
AutoRef: Harness Optimization for Agentic Multi-Reference Image Generation Paper • 2609.35530 • Published 9 days ago • 21
Just-in-Time Memory: Learning to Curate Task-Adaptive Memory for LLM Agents Paper • 2609.27334 • Published 14 days ago • 56
ExpVoyager: Direct Experience Navigation for Dynamic Agent Skill Synthesis Paper • 2609.32630 • Published 11 days ago • 19
TraceDance: An Automated System for Building Agent Behavior Benchmarks from Real-World Agent Deployment Traces Paper • 2609.33295 • Published 10 days ago • 72
Skill2Env: Capability-Oriented Environment Synthesis from Skills for General Agents Paper • 2609.33772 • Published 10 days ago • 35
DepthBench: Measuring How Residual Connections Enable More Computational Depth Paper • 2609.32534 • Published 11 days ago • 32
IndicBankBench: Evaluating Safety and Reliability of Language Model Assistants in Indian Retail Banking Paper • 2609.29167 • Published 13 days ago • 22
Qwen-Planner-Agent: A Closed-Loop AI-for-AI Framework for Real-World Mobile Planner Agents Paper • 2609.29892 • Published 13 days ago • 33
Agent-Editing World Model: Rethinking World Modeling for LLM Agents Paper • 2609.28416 • Published 14 days ago • 43
PUBG Ally: A Conversational Embodied Agent as an AI Teammate Paper • 2609.29837 • Published 13 days ago • 25
IterSynth: Rethinking Deep Search Agents via Role-Decoupled Iterative Synthesis Paper • 2609.29444 • Published 13 days ago • 21