Picture for Cheng Yan

Cheng Yan

Beyond Global Routing Aggregation: Phase-Aware Expert Merging for MoE Vision-Language Models

Add code
Aug 05, 2026
Viaarxiv icon

DAVET: Denoising-Aware Visual Evidence Trajectory Allocation for Diffusion Vision-Language Models

Add code
Aug 03, 2026
Viaarxiv icon

REFLEX: Rethinking MoE Inference as Refinement-Aware Compute Allocation in Diffusion Language Models

Add code
Aug 03, 2026
Viaarxiv icon

Is Your Model Thinking or Just Stagnating? PUMA: Diagnosing Reasoning Pathology via Phase-Momentum Alignment

Add code
Jul 19, 2026
Viaarxiv icon

GeoQuery: Geometry-Query Diffusion for Sparse-View Reconstruction

Add code
May 12, 2026
Viaarxiv icon

Let Your Image Move with Your Motion! -- Implicit Multi-Object Multi-Motion Transfer

Add code
Mar 01, 2026
Viaarxiv icon

LCDB 1.1: A Database Illustrating Learning Curves Are More Ill-Behaved Than Previously Thought

Add code
May 21, 2025
Figure 1 for LCDB 1.1: A Database Illustrating Learning Curves Are More Ill-Behaved Than Previously Thought
Figure 2 for LCDB 1.1: A Database Illustrating Learning Curves Are More Ill-Behaved Than Previously Thought
Figure 3 for LCDB 1.1: A Database Illustrating Learning Curves Are More Ill-Behaved Than Previously Thought
Figure 4 for LCDB 1.1: A Database Illustrating Learning Curves Are More Ill-Behaved Than Previously Thought
Viaarxiv icon

ROS-SAM: High-Quality Interactive Segmentation for Remote Sensing Moving Object

Add code
Mar 15, 2025
Figure 1 for ROS-SAM: High-Quality Interactive Segmentation for Remote Sensing Moving Object
Figure 2 for ROS-SAM: High-Quality Interactive Segmentation for Remote Sensing Moving Object
Figure 3 for ROS-SAM: High-Quality Interactive Segmentation for Remote Sensing Moving Object
Figure 4 for ROS-SAM: High-Quality Interactive Segmentation for Remote Sensing Moving Object
Viaarxiv icon

Dual-Modal Prototype Joint Learning for Compositional Zero-Shot Learning

Add code
Jan 23, 2025
Figure 1 for Dual-Modal Prototype Joint Learning for Compositional Zero-Shot Learning
Figure 2 for Dual-Modal Prototype Joint Learning for Compositional Zero-Shot Learning
Figure 3 for Dual-Modal Prototype Joint Learning for Compositional Zero-Shot Learning
Figure 4 for Dual-Modal Prototype Joint Learning for Compositional Zero-Shot Learning
Viaarxiv icon

A New Action Recognition Framework for Video Highlights Summarization in Sporting Events

Add code
Dec 01, 2020
Figure 1 for A New Action Recognition Framework for Video Highlights Summarization in Sporting Events
Figure 2 for A New Action Recognition Framework for Video Highlights Summarization in Sporting Events
Figure 3 for A New Action Recognition Framework for Video Highlights Summarization in Sporting Events
Figure 4 for A New Action Recognition Framework for Video Highlights Summarization in Sporting Events
Viaarxiv icon