Picture for Haozhe Hu

Haozhe Hu

WIDE: Boosting Adaptive LLM Inference via Token-level Dynamic Width Pruning

Add code
Jul 30, 2026
Viaarxiv icon

UniRank: Unified Rank Allocation for Low-Rank LLM Compression

Add code
Jun 20, 2026
Viaarxiv icon

Beyond FLOPs: Benchmarking Real Inference Acceleration of LLM Pruning under a GEMM-Centric Taxonomy

Add code
Jun 08, 2026
Viaarxiv icon

CS-MUNet: A Channel-Spatial Dual-Stream Mamba Network for Multi-Organ Segmentation

Add code
Mar 20, 2026
Viaarxiv icon