Picture for Hao Gu

Hao Gu

Fewer Tokens, Smaller Cache: Reward-Coordinated Efficient Reasoning

Add code
Aug 05, 2026
Viaarxiv icon

Hierarchical Sparse Attention Done Right: Toward Infinite Context Modeling

Add code
Jul 03, 2026
Viaarxiv icon

IndexMem: Learned KV-Cache Eviction with Latent Memory for Long-Context LLM Inference

Add code
May 25, 2026
Viaarxiv icon

QaRL: Rollout-Aligned Quantization-Aware RL for Fast and Stable Training under Training--Inference Mismatch

Add code
Apr 09, 2026
Viaarxiv icon

Bit-by-Bit: Progressive QAT Strategy with Outlier Channel Splitting for Stable Low-Bit LLMs

Add code
Apr 09, 2026
Viaarxiv icon

Learning While Staying Curious: Entropy-Preserving Supervised Fine-Tuning via Adaptive Self-Distillation for Large Reasoning Models

Add code
Feb 02, 2026
Viaarxiv icon

Spectral Imbalance Causes Forgetting in Low-Rank Continual Adaptation

Add code
Jan 31, 2026
Viaarxiv icon

OV-InstructTTS: Towards Open-Vocabulary Instruct Text-to-Speech

Add code
Jan 04, 2026
Viaarxiv icon

R4ec: A Reasoning, Reflection, and Refinement Framework for Recommendation Systems

Add code
Jul 23, 2025
Viaarxiv icon

Hierarchical Tree Search-based User Lifelong Behavior Modeling on Large Language Model

Add code
May 26, 2025
Viaarxiv icon