Picture for Shuoqin Zhang

Shuoqin Zhang

EvoHIL: Self-Evolving Reward and Flow-Matched Policy Optimization for Robust Human-in-the-Loop Reinforcement Learning

Add code
Aug 04, 2026
Viaarxiv icon

RoHIL: Robust Human-in-the-Loop Robotic Reinforcement Learning Against Illumination Variations

Add code
May 19, 2026
Viaarxiv icon