Picture for Guozheng Ma

Guozheng Ma

Beyond Isolation: Unlocking Reinforcement Learning Component Synergy for Sample-Efficient Continuous Control

Add code
Aug 07, 2026
Viaarxiv icon

Exploration Matters for Escaping the Blur Trap in 3D Gaussian Splatting

Add code
Jul 20, 2026
Viaarxiv icon

ExToken: Structured Exploration for Efficient Vision-Language-Action Reinforcement Fine-tuning

Add code
Jul 14, 2026
Viaarxiv icon

Beyond One-Size-Fits-All: Diagnosis-Driven Online Reinforcement Learning with Offline Priors

Add code
Jun 24, 2026
Viaarxiv icon

What Makes Value Learning Efficient in Residual Reinforcement Learning?

Add code
Feb 11, 2026
Viaarxiv icon

Language-based Trial and Error Falls Behind in the Era of Experience

Add code
Jan 29, 2026
Viaarxiv icon

Towards Reliable Medical LLMs: Benchmarking and Enhancing Confidence Estimation of Large Language Models in Medical Consultation

Add code
Jan 22, 2026
Viaarxiv icon

Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer

Add code
May 30, 2025
Figure 1 for Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
Figure 2 for Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
Figure 3 for Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
Figure 4 for Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
Viaarxiv icon

Plasticine: Accelerating Research in Plasticity-Motivated Deep Reinforcement Learning

Add code
Apr 24, 2025
Viaarxiv icon

Faster and Better 3D Splatting via Group Training

Add code
Dec 10, 2024
Figure 1 for Faster and Better 3D Splatting via Group Training
Figure 2 for Faster and Better 3D Splatting via Group Training
Figure 3 for Faster and Better 3D Splatting via Group Training
Figure 4 for Faster and Better 3D Splatting via Group Training
Viaarxiv icon