Picture for Yuxian Gu

Yuxian Gu

Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE

Add code
Jul 08, 2026
Viaarxiv icon

LLM-in-Sandbox Elicits General Agentic Intelligence

Add code
Jan 22, 2026
Viaarxiv icon

Trust-Region Adaptive Policy Optimization

Add code
Dec 19, 2025
Figure 1 for Trust-Region Adaptive Policy Optimization
Figure 2 for Trust-Region Adaptive Policy Optimization
Figure 3 for Trust-Region Adaptive Policy Optimization
Figure 4 for Trust-Region Adaptive Policy Optimization
Viaarxiv icon

Data-Efficient RLVR via Off-Policy Influence Guidance

Add code
Oct 30, 2025
Viaarxiv icon

NVILA: Efficient Frontier Visual Language Models

Add code
Dec 05, 2024
Figure 1 for NVILA: Efficient Frontier Visual Language Models
Figure 2 for NVILA: Efficient Frontier Visual Language Models
Figure 3 for NVILA: Efficient Frontier Visual Language Models
Figure 4 for NVILA: Efficient Frontier Visual Language Models
Viaarxiv icon

MiniPLM: Knowledge Distillation for Pre-Training Language Models

Add code
Oct 22, 2024
Viaarxiv icon

Data Selection via Optimal Control for Language Models

Add code
Oct 09, 2024
Figure 1 for Data Selection via Optimal Control for Language Models
Figure 2 for Data Selection via Optimal Control for Language Models
Figure 3 for Data Selection via Optimal Control for Language Models
Figure 4 for Data Selection via Optimal Control for Language Models
Viaarxiv icon

Direct Preference Knowledge Distillation for Large Language Models

Add code
Jun 28, 2024
Figure 1 for Direct Preference Knowledge Distillation for Large Language Models
Figure 2 for Direct Preference Knowledge Distillation for Large Language Models
Figure 3 for Direct Preference Knowledge Distillation for Large Language Models
Figure 4 for Direct Preference Knowledge Distillation for Large Language Models
Viaarxiv icon

Instruction Pre-Training: Language Models are Supervised Multitask Learners

Add code
Jun 20, 2024
Viaarxiv icon

Towards Optimal Learning of Language Models

Add code
Mar 03, 2024
Viaarxiv icon