Persona Dosing: Calibrated Activation Steering for Graded Trait Control Paper • 2609.36388 • Published 13 days ago • 56
Science or Slop?: Benchmarking and Mitigating Scientific Slop in AI-Generated Papers Paper • 2610.00531 • Published 11 days ago • 62
VeriHarness: Scaling Agentic Verification for Long-Horizon Tasks Paper • 2610.00972 • Published 10 days ago • 60
Memadapter: Counterfactual Adaptation Against Memory-induced Sycophancy Paper • 2610.05162 • Published 7 days ago • 60
More Choices, Fewer Decisions: Ordinal-Scale Bias in JEV-like Direct-Decision Models Paper • 2609.38827 • Published 11 days ago • 62
Questioning the Questions: Sustaining Self-Evolution in Reasoning Models Paper • 2610.04299 • Published 8 days ago • 70
DecepEval: A Benchmark for Evaluating Deception in LLM Agents Paper • 2610.07967 • Published 5 days ago • 74
Thinking Outside the Box: Can Language Models Rely on External Guidance Selectively? Paper • 2609.39578 • Published 11 days ago • 72
Transformers Stop Thinking Too Early, and a Tiny LoRA Fixes It Paper • 2609.36585 • Published 12 days ago • 70
ActiveSaddler: Automated Curriculum Learning for Agent Harness Optimization Paper • 2610.00906 • Published 10 days ago • 84
Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States Paper • 2610.01415 • Published 10 days ago • 91
Prefill-Free Cross-Family KV Cache Transfer for Heterogeneous Multi-Agent LLMs Paper • 2609.32259 • Published 12 days ago • 100
TokenRouter: Efficient Serving System for Token-Level LLM Routing Paper • 2610.12242 • Published 3 days ago • 124
Mid-Harness: Scaling Actions Between Model and Harness for Terminal Agents Paper • 2609.39982 • Published 11 days ago • 120
Self-Retrospection Distillation: Turning Post-hoc Experiences into Prior Foresight Paper • 2610.08077 • Published 5 days ago • 141
AREX-2: Advancing Self-Improving Agents through Long-Horizon Reflective Tasks Paper • 2609.38288 • Published 12 days ago • 137