Picture for Lanbo Liu

Lanbo Liu

Step-Level On-Policy Distillation: Interpolating Between On-Policy Distillation and Supervised Fine-Tuning

Add code
Aug 17, 2026
Viaarxiv icon

Rewarding Creativity: A Human-Aligned Generative Reward Model for Reinforcement Learning in Storytelling

Add code
Jan 12, 2026
Viaarxiv icon

Deep Learning Inversion of Electrical Resistivity Data

Add code
Apr 10, 2019
Figure 1 for Deep Learning Inversion of Electrical Resistivity Data
Figure 2 for Deep Learning Inversion of Electrical Resistivity Data
Figure 3 for Deep Learning Inversion of Electrical Resistivity Data
Figure 4 for Deep Learning Inversion of Electrical Resistivity Data
Viaarxiv icon