Picture for Qinan Huang

Qinan Huang

Active-GRPO: Adaptive Imitation and Self-Improving Reasoning for Molecular Optimization

Add code
Jul 01, 2026
Viaarxiv icon