Picture for Lei Jiang

Lei Jiang

Reusing Rollouts under Policy Lag: Prefix-Normalized Policy Optimization for LLM Reinforcement Learning

Add code
Aug 02, 2026
Viaarxiv icon

Adaptive FastOPD: Progress-Aware Rollout Horizon Expansion for Efficient On-Policy Distillation

Add code
Jul 31, 2026
Viaarxiv icon

MolGVR: A Chemistry-Grounded Framework for Text-to-Molecule Generation

Add code
Jul 31, 2026
Viaarxiv icon

OpenFinGym: A Verifiable Multi-Task Gym Environment for Evaluating Quant Agents

Add code
Jun 24, 2026
Viaarxiv icon

SWAP: Symmetric Equivariant World-Model for Agile Robot Parkour

Add code
Jun 18, 2026
Viaarxiv icon

When the Same Musical Knowledge Forgets Differently: A Clean Probe of Pathway-Dependent Forgetting

Add code
Jun 17, 2026
Viaarxiv icon

Beyond NL2Code: A Structured Survey of Multimodal Code Intelligence

Add code
Jun 16, 2026
Viaarxiv icon

Beyond WER: A Paired Acoustic Stress Test for Ambient Clinical Scribes

Add code
Jun 04, 2026
Viaarxiv icon

MOSAIC: Modular Orchestration for Structured Agentic Intelligence and Composition

Add code
May 30, 2026
Viaarxiv icon

ELAN4D: Embodiment-Centric 4D Supervision for Vision-Language-Action Models via Plug-and-Play Adaptation

Add code
May 28, 2026
Viaarxiv icon