Picture for Yizeng Han

Yizeng Han

ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding

Add code
Jul 27, 2026
Viaarxiv icon

Agent-as-a-Router: Agentic Model Routing for Coding Tasks

Add code
Jun 24, 2026
Viaarxiv icon

Towards 3D-Aware Video Diffusion Models: Render-Free Human Motion Control with Mesh Tokenization

Add code
Jun 01, 2026
Viaarxiv icon

Few-Step Distillation for Text-to-Image Generation: A Practical Guide

Add code
Dec 15, 2025
Viaarxiv icon

RAPID^3: Tri-Level Reinforced Acceleration Policies for Diffusion Transformer

Add code
Sep 26, 2025
Viaarxiv icon

Emulating Human-like Adaptive Vision for Efficient and Flexible Machine Visual Perception

Add code
Sep 18, 2025
Viaarxiv icon

FPSAttention: Training-Aware FP8 and Sparsity Co-Design for Fast Video Diffusion

Add code
Jun 06, 2025
Viaarxiv icon

DyDiT++: Dynamic Diffusion Transformers for Efficient Visual Generation

Add code
Apr 09, 2025
Viaarxiv icon

Bridging the Divide: Reconsidering Softmax and Linear Attention

Add code
Dec 09, 2024
Figure 1 for Bridging the Divide: Reconsidering Softmax and Linear Attention
Figure 2 for Bridging the Divide: Reconsidering Softmax and Linear Attention
Figure 3 for Bridging the Divide: Reconsidering Softmax and Linear Attention
Figure 4 for Bridging the Divide: Reconsidering Softmax and Linear Attention
Viaarxiv icon

A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs

Add code
Dec 05, 2024
Figure 1 for A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs
Figure 2 for A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs
Figure 3 for A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs
Figure 4 for A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs
Viaarxiv icon