Picture for Hanfeng Lu

Hanfeng Lu

From LLM Inference to Agentic Workloads: Characterization and Implications for Serving Systems

Add code
Aug 15, 2026
Viaarxiv icon

Rollplex: Cross-Phase GPU Spatial Sharing for Vision Language Model Post-Training

Add code
Aug 14, 2026
Viaarxiv icon

SwiftDiffusion: Efficient Diffusion Model Serving with Add-on Modules

Add code
Jul 02, 2024
Figure 1 for SwiftDiffusion: Efficient Diffusion Model Serving with Add-on Modules
Figure 2 for SwiftDiffusion: Efficient Diffusion Model Serving with Add-on Modules
Figure 3 for SwiftDiffusion: Efficient Diffusion Model Serving with Add-on Modules
Figure 4 for SwiftDiffusion: Efficient Diffusion Model Serving with Add-on Modules
Viaarxiv icon