Picture for Hongyan Xie

Hongyan Xie

Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs

Add code
Aug 03, 2026
Viaarxiv icon

Multi-Objective Exploration and Preference Optimization via Mutual Information

Add code
Jul 01, 2026
Viaarxiv icon

UniARM: Towards a Unified Autoregressive Reward Model for Multi-Objective Test-Time Alignment

Add code
Feb 10, 2026
Viaarxiv icon

Does Your Reasoning Model Implicitly Know When to Stop Thinking?

Add code
Feb 09, 2026
Viaarxiv icon

Real-Time Aligned Reward Model beyond Semantics

Add code
Jan 30, 2026
Viaarxiv icon