Picture for Wankou Yang

Wankou Yang

ScanFocus: A Coarse-to-Fine Framework for Spatio-Temporal Video Grounding

Add code
Jul 15, 2026
Viaarxiv icon

SimpleSearch-VL: A Simple Recipe for Multimodal Agentic Deep Search

Add code
Jun 30, 2026
Viaarxiv icon

VideoSEG-O3: A Multi-turn Reinforcement Learning Framework for Reasoning Video Object Segmentation

Add code
Jun 05, 2026
Viaarxiv icon

UW-VOS: A Large-Scale Dataset for Underwater Video Object Segmentation

Add code
Mar 25, 2026
Viaarxiv icon

SFFR: Spatial-Frequency Feature Reconstruction for Multispectral Aerial Object Detection

Add code
Nov 17, 2025
Viaarxiv icon

IRDFusion: Iterative Relation-Map Difference guided Feature Fusion for Multispectral Object Detection

Add code
Sep 11, 2025
Viaarxiv icon

PropVG: End-to-End Proposal-Driven Visual Grounding with Multi-Granularity Discrimination

Add code
Sep 05, 2025
Viaarxiv icon

DeRIS: Decoupling Perception and Cognition for Enhanced Referring Image Segmentation through Loopback Synergy

Add code
Jul 02, 2025
Viaarxiv icon

Vision Remember: Alleviating Visual Forgetting in Efficient MLLM with Vision Feature Resample

Add code
Jun 04, 2025
Viaarxiv icon

Improving underwater semantic segmentation with underwater image quality attention and muti-scale aggregation attention

Add code
Mar 30, 2025
Viaarxiv icon