Picture for Yongjian Guo

Yongjian Guo

On-Policy Distillation for LLM Safety: A Routing Approach to Template-Robust Realignment

Add code
Jul 29, 2026
Viaarxiv icon

JoyNexus: Service-Oriented Multi-Tenant Post-Training for VLA Models

Add code
Jul 17, 2026
Viaarxiv icon

Embodied Operators and Benchmarking: Toward Reusable and Deployable Embodied Intelligence Systems

Add code
Jul 03, 2026
Viaarxiv icon

Building a Scalable, Reproducible, Evaluatable, and Closed-Loop Simulation Environment Foundation for Embodied Intelligence

Add code
Jul 01, 2026
Viaarxiv icon

Pre-VLA: Preemptive Runtime Verification for Reliable Vision-Language-Action and World-Model Rollouts

Add code
May 21, 2026
Viaarxiv icon

D-VLA: A High-Concurrency Distributed Asynchronous Reinforcement Learning Framework for Vision-Language-Action Models

Add code
May 14, 2026
Viaarxiv icon

Missing Old Logits in Asynchronous Agentic RL: Semantic Mismatch and Repair Methods for Off-Policy Correction

Add code
May 12, 2026
Viaarxiv icon

Customizing Large Vision Model-Guided Low-Rank Approximation for Ground-Roll Denoise

Add code
Apr 01, 2026
Viaarxiv icon

Thousand-GPU Large-Scale Training and Optimization Recipe for AI-Native Cloud Embodied Intelligence Infrastructure

Add code
Mar 11, 2026
Viaarxiv icon

RL-VLA$^3$: Reinforcement Learning VLA Accelerating via Full Asynchronism

Add code
Feb 05, 2026
Viaarxiv icon