HarnessEval-W: Agentifying the Evaluation of Visual Worlds Paper • 2608.16859 • Published 5 days ago • 123
Spark-to-Paper: End-to-End Research Paper Generation as a Composable Skill Paper • 2608.11924 • Published 10 days ago • 285
LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks Paper • 2608.01964 • Published 19 days ago • 180
Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents Paper • 2607.28227 • Published 23 days ago • 307
ReDesign: Recovering Editable Design Structures from Images via Agentic Decomposition Paper • 2607.25565 • Published 25 days ago • 66
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable Paper • 2607.13285 • Published Jul 14 • 235
MoE-GRPO: Optimizing Mixture-of-Experts via Reinforcement Learning in Vision-Language Models Paper • 2603.24984 • Published Mar 29 • 1
VideoSearch-R1: Iterative Video Retrieval and Reasoning via Soft Query Refinement Paper • 2607.00446 • Published Jul 1 • 24
MoE-GRPO: Optimizing Mixture-of-Experts via Reinforcement Learning in Vision-Language Models Paper • 2603.24984 • Published Mar 29 • 1
VideoSearch-R1: Iterative Video Retrieval and Reasoning via Soft Query Refinement Paper • 2607.00446 • Published Jul 1 • 24