Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published 7 days ago • 291
PaperGym: Rubric-Centered Evolution for Research-Plan Generation Paper • 2608.31119 • Published 10 days ago • 41
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning Paper • 2608.05987 • Published Aug 6 • 102
CreativeBench: Benchmarking and Enhancing Machine Creativity via Self-Evolving Challenges Paper • 2603.11863 • Published Mar 12 • 8