Picture for XiaoDong Wu

XiaoDong Wu

HiL-ResRL: A Model-Agnostic Finetuning Adapter via Human-in-the-loop Residual Reinforcement Learning

Add code
Jun 22, 2026
Viaarxiv icon