Picture for Hongyang Cheng

Hongyang Cheng

Robo-Dopamine 2.0: History-Conditioned and OOD-Aware Process Reward Modeling for Robotic Manipulation

Add code
Aug 16, 2026
Viaarxiv icon

WorldSimProbe: Diagnosing Simulator Faithfulness in Action-Conditioned World Models for Embodied Manipulation

Add code
Aug 10, 2026
Viaarxiv icon

FORCE: Efficient VLA Reinforcement Fine-Tuning via Value-Calibrated Warm-up and Self-Distillation

Add code
Jun 24, 2026
Viaarxiv icon