SimpleOPD: Simple Tokenizer-Agnostic On-Policy Distillation for Long-Context Reasoning Paper • 2608.14277 • Published 8 days ago • 32
HarnessOpt-Bench: Evaluating LLMs at Harness Optimization Paper • 2608.06301 • Published 16 days ago • 35
OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents Paper • 2608.05013 • Published 18 days ago • 37
SPADE: Self-Play in Adaptive Synthetic Executable Environments Paper • 2608.19197 • Published 3 days ago • 44
EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning Paper • 2608.06197 • Published 16 days ago • 45
Agent Memory Distillation: Empowering Small LLM Agents with Hierarchical Teacher Memory Paper • 2608.07169 • Published 15 days ago • 50
Beyond Final Scores: A Systematic Evaluation of Agents for Long-Horizon AI Research and Development Paper • 2608.13417 • Published 9 days ago • 52
SFT Conflicts, RL Coexists: A Theoretical and Empirical Analysis of Multi-Task Learning for LLMs Paper • 2608.03573 • Published 16 days ago • 56
AutoDesign: Meta-Harness Optimization for Long-Horizon Agentic Design Paper • 2608.13560 • Published 9 days ago • 53
Large Discovery Models: Empirically-grounded Model-Based Open-Ended Search Paper • 2608.15669 • Published 6 days ago • 61
Ouroboros: A Self-Developing Frontier Coding Agent with Reviewed Core Evolution Paper • 2608.08311 • Published 14 days ago • 89
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning Paper • 2608.05987 • Published 16 days ago • 100
DarwinX: Evolving Agent Harnesses Through Natural Selection Paper • 2608.07545 • Published 22 days ago • 110
Co-Evolution in Agentic Systems: Toward Self-Directed Evolution Beyond Human Design Paper • 2608.10299 • Published 12 days ago • 134
Demystifying Agent Skills: Why They Work-Until They Don't Paper • 2608.14036 • Published 8 days ago • 158
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published 21 days ago • 261