Picture for Yikun Ban

Yikun Ban

Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs

Add code
Aug 03, 2026
Viaarxiv icon

Multi-Objective Exploration and Preference Optimization via Mutual Information

Add code
Jul 01, 2026
Viaarxiv icon

Frequency-Aware Flow Matching for Continuous and Consistent Robotic Action Generation

Add code
Jun 18, 2026
Viaarxiv icon

When Self-Belief Misleads: Active Label Acquisition for Reinforcement Learning with Verifiable Rewards

Add code
May 25, 2026
Viaarxiv icon

Policy Improvement Reinforcement Learning

Add code
Apr 01, 2026
Viaarxiv icon

Counterfactual Credit Policy Optimization for Multi-Agent Collaboration

Add code
Mar 23, 2026
Viaarxiv icon

Adaptive Robust Estimator for Multi-Agent Reinforcement Learning

Add code
Mar 23, 2026
Viaarxiv icon

CDRRM: Contrast-Driven Rubric Generation for Reliable and Interpretable Reward Modeling

Add code
Mar 09, 2026
Viaarxiv icon

Heterogeneous Agent Collaborative Reinforcement Learning

Add code
Mar 03, 2026
Viaarxiv icon

UniFAR: A Unified Facet-Aware Retrieval Framework for Scientific Documents

Add code
Feb 27, 2026
Viaarxiv icon