Picture for Jianze Wang

Jianze Wang

SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning

Add code
Jul 29, 2026
Viaarxiv icon

Rethinking Scientific Modeling: Toward Physically Consistent and Simulation-Executable Programmatic Generation

Add code
Feb 06, 2026
Viaarxiv icon