Picture for Zhuo Sun

Zhuo Sun

SR-OPSD: Self-Referenced On-Policy Self-Distillation

Add code
Aug 10, 2026
Viaarxiv icon

What Language Does and What the Evidence Supports: A Functional Role Taxonomy and Evidence Audit of Language Grounding in Embodied Agents

Add code
Aug 04, 2026
Viaarxiv icon

Scaling World-Model Reinforcement Learning Through Diffusion Policy Optimization

Add code
May 25, 2026
Viaarxiv icon

Interdomain Attention: Beyond Token-Level Key-Value Memory

Add code
May 23, 2026
Viaarxiv icon

Saliency-Aware Regularized Quantization Calibration for Large Language Models

Add code
May 07, 2026
Viaarxiv icon

Fisher Decorator: Refining Flow Policy via A Local Transport Map

Add code
Apr 20, 2026
Viaarxiv icon

ERNIE 5.0 Technical Report

Add code
Feb 04, 2026
Viaarxiv icon

On Stability and Robustness of Diffusion Posterior Sampling for Bayesian Inverse Problems

Add code
Feb 02, 2026
Viaarxiv icon

How Does the Lagrangian Guide Safe Reinforcement Learning through Diffusion Models?

Add code
Feb 02, 2026
Viaarxiv icon

MemoCue: Empowering LLM-Based Agents for Human Memory Recall via Strategy-Guided Querying

Add code
Jul 31, 2025
Viaarxiv icon