Agent-Editing World Model: Rethinking World Modeling for LLM Agents Paper • 2609.28416 • Published 10 days ago • 42
LLaDA MoE v2: Scaling Mixture-of-Experts Diffusion Language Models Paper • 2608.03457 • Published Aug 4 • 35
TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning Paper • 2608.04007 • Published Aug 4 • 20
OneRank: Unified Transformer-Native Ranking Architecture for Multi-Task Recommendation Paper • 2606.16838 • Published Jun 15 • 19
Towards Verifiable Multimodal Deep Research: A Multi-Agent Harness for Interleaved Report Generation Paper • 2605.29861 • Published May 28 • 11
Agentic Fusion of Large Atomic and Language Models to Accelerate Superconductors Discovery Paper • 2604.23758 • Published Apr 29 • 8
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis Paper • 2505.16834 • Published May 22, 2025
SWE-World: Building Software Engineering Agents in Docker-Free Environments Paper • 2602.03419 • Published Feb 3 • 42
SWE-Master: Unleashing the Potential of Software Engineering Agents via Post-Training Paper • 2602.03411 • Published Feb 3 • 39
ClawGym: A Scalable Framework for Building Effective Claw Agents Paper • 2604.26904 • Published Apr 29 • 55
MR$^2$-Bench: Going Beyond Matching to Reasoning in Multimodal Retrieval Paper • 2509.26378 • Published Sep 30, 2025
DR-Venus: Towards Frontier Edge-Scale Deep Research Agents with Only 10K Open Data Paper • 2604.19859 • Published Apr 21 • 53
Length-Induced Embedding Collapse in Transformer-based Models Paper • 2410.24200 • Published Oct 31, 2024 • 2
Source Echo Chamber: Exploring the Escalation of Source Bias in User, Data, and Recommender System Feedback Loop Paper • 2405.17998 • Published May 28, 2024
CHOP: Mobile Operating Assistant with Constrained High-frequency Optimized Subtask Planning Paper • 2503.03743 • Published Mar 5, 2025
GUI-G1: Understanding R1-Zero-Like Training for Visual Grounding in GUI Agents Paper • 2505.15810 • Published May 21, 2025