Picture for Weizhong Zhang

Weizhong Zhang

OnlineCache: Learning Dynamic Caching Policies with Error Correction for Efficient Diffusion Inference

Add code
Jul 31, 2026
Viaarxiv icon

LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget

Add code
Jul 16, 2026
Viaarxiv icon

Distill on a Diet: Efficient Knowledge Distillation via Learnable Data Pruning

Add code
Jun 24, 2026
Viaarxiv icon

Holistic Scaling Laws for Optimal Mixture-of-Experts Architecture Optimization

Add code
Mar 23, 2026
Viaarxiv icon

Timestep-Aware Block Masking for Efficient Diffusion Model Inference

Add code
Mar 20, 2026
Viaarxiv icon

AutoQRA: Joint Optimization of Mixed-Precision Quantization and Low-rank Adapters for Efficient LLM Fine-Tuning

Add code
Feb 25, 2026
Viaarxiv icon

Investigating Data Pruning for Pretraining Biological Foundation Models at Scale

Add code
Dec 15, 2025
Viaarxiv icon

Explore and Establish Synergistic Effects Between Weight Pruning and Coreset Selection in Neural Network Training

Add code
Nov 17, 2025
Viaarxiv icon

Advanced Black-Box Tuning of Large Language Models with Limited API Calls

Add code
Nov 17, 2025
Figure 1 for Advanced Black-Box Tuning of Large Language Models with Limited API Calls
Figure 2 for Advanced Black-Box Tuning of Large Language Models with Limited API Calls
Figure 3 for Advanced Black-Box Tuning of Large Language Models with Limited API Calls
Figure 4 for Advanced Black-Box Tuning of Large Language Models with Limited API Calls
Viaarxiv icon

Towards Robust Influence Functions with Flat Validation Minima

Add code
May 25, 2025
Viaarxiv icon