Picture for Ron Polonsky

Ron Polonsky

Do You Really Need to Pretrain Q-Functions for Online RL Fine-Tuning?

Add code
Jul 29, 2026
Viaarxiv icon

Document Optimization for Black-Box Retrieval via Reinforcement Learning

Add code
Apr 06, 2026
Viaarxiv icon