Picture for Tianyu Feng

Tianyu Feng

From LLM Inference to Agentic Workloads: Characterization and Implications for Serving Systems

Add code
Aug 15, 2026
Viaarxiv icon

Rollplex: Cross-Phase GPU Spatial Sharing for Vision Language Model Post-Training

Add code
Aug 14, 2026
Viaarxiv icon

ServerlessT2I: Efficient Text-to-Image Workflow Serving on a Serverless Platform

Add code
Jul 29, 2026
Viaarxiv icon

LegoDiffusion: Micro-Serving Text-to-Image Diffusion Workflows

Add code
Apr 09, 2026
Viaarxiv icon

InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling

Add code
May 27, 2025
Figure 1 for InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling
Figure 2 for InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling
Figure 3 for InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling
Figure 4 for InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling
Viaarxiv icon