Picture for Jionghao Bai

Jionghao Bai

Distilled Reinforcement Learning for LLM Post-training

Add code
Jul 19, 2026
Viaarxiv icon

Attend to Evidence: Evidence-Anchored Spatial Attention Supervision for Multimodal RLVR

Add code
May 29, 2026
Viaarxiv icon

Distribution-Centric Policy Optimization Dominates Exploration-Exploitation Trade-off

Add code
Jan 19, 2026
Viaarxiv icon

Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer

Add code
Sep 14, 2023
Figure 1 for Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer
Figure 2 for Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer
Figure 3 for Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer
Figure 4 for Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer
Viaarxiv icon