Picture for Michael Ying Yang

Michael Ying Yang

Seeing Before Answering: Training-Free Visual Layer Profiling for Vision-Language Models

Add code
Aug 17, 2026
Viaarxiv icon

OvDSGG: End-to-End Open-Vocabulary Dynamic Scene Graph Generation

Add code
Aug 14, 2026
Viaarxiv icon

PUF: Plug-and-Play Uncertainty-Aware Fusion for Online 3D Scene Graph Generation

Add code
Jul 08, 2026
Viaarxiv icon

UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation

Add code
Jul 06, 2026
Viaarxiv icon

Semantic-Driven Scale and Spatial Selection for Efficient Cross-Modal Alignment in Referring Remote Sensing Image Segmentation

Add code
Jun 29, 2026
Viaarxiv icon

DriveVA: Video Action Models are Zero-Shot Drivers

Add code
Apr 05, 2026
Viaarxiv icon

RegFormer++: An Efficient Large-Scale 3D LiDAR Point Registration Network with Projection-Aware 2D Transformer

Add code
Mar 15, 2026
Viaarxiv icon

Query-Guided Spatial-Temporal-Frequency Interaction for Music Audio-Visual Question Answering

Add code
Jan 27, 2026
Viaarxiv icon

4DSTR: Advancing Generative 4D Gaussians with Spatial-Temporal Rectification for High-Quality and Consistent 4D Generation

Add code
Nov 10, 2025
Viaarxiv icon

Scale-wise Bidirectional Alignment Network for Referring Remote Sensing Image Segmentation

Add code
Jan 06, 2025
Viaarxiv icon