Picture for Zhuoran Jin

Zhuoran Jin

The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences, Beijing, China

Beyond Simply Environment Scaling: Designing Effective Environment Distributions for Multimodal Agent Learning

Add code
Aug 06, 2026
Viaarxiv icon

SFT Conflicts, RL Coexists: A Theoretical and Empirical Analysis of Multi-Task Learning for LLMs

Add code
Aug 06, 2026
Viaarxiv icon

The Physics of Multi-Turn Long-Horizon Planning: From Pre-training to Post-training via Single- and Multi-Teacher On-Policy Agentic Distillation

Add code
Jul 27, 2026
Viaarxiv icon

Empowering GUI Agents via Autonomous Experience Exploration and Hindsight Experience Utilization for Task Planning

Add code
Jun 25, 2026
Viaarxiv icon

Why Multi-Step Tool-Use Reinforcement Learning Collapses and How Supervisory Signals Fix It

Add code
Jun 24, 2026
Viaarxiv icon

Look Light, Think Heavy: What Multimodal Chain-of-Thought Reasoning Can and Cannot Do

Add code
Jun 21, 2026
Viaarxiv icon

Replay What Matters: Off-Policy Replay for Efficient LLM Reinforcement Unlearning

Add code
Jun 13, 2026
Viaarxiv icon

Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application

Add code
Jun 10, 2026
Viaarxiv icon

Pushing the Limits of LLM Tool Calling via Experiential Knowledge Integration and Activation

Add code
Jun 09, 2026
Viaarxiv icon

Think While Watching: Online Streaming Segment-Level Memory for Multi-Turn Video Reasoning in Multimodal Large Language Models

Add code
Mar 12, 2026
Viaarxiv icon