Picture for Liujuan Cao

Liujuan Cao

TennisVAR: A Stroke-Evidence-Grounded Multimodal Large Language Model for Tactical Reasoning in Tennis Videos

Add code
Aug 13, 2026
Viaarxiv icon

LASA: Language-and-Source-Anchored Alignment for Domain Generalized Semantic Segmentation

Add code
Aug 09, 2026
Viaarxiv icon

GFR-SAM: Training-Free Referring Camouflaged Object Segmentation via Cross-Image Prompting

Add code
Jul 13, 2026
Viaarxiv icon

PAR3D: A Unified 3D-MLLM with Part-Aware Representation for Scene Understanding

Add code
Jun 04, 2026
Viaarxiv icon

SkyShield: Occupancy as a Safety Interface for Low-Altitude UAV Autonomy

Add code
May 30, 2026
Viaarxiv icon

Active-SAOOD: Active Sparsely Annotated Oriented Object Detection in Remote Sensing Images

Add code
May 11, 2026
Viaarxiv icon

DPM++: Dynamic Masked Metric Learning for Occluded Person Re-identification

Add code
May 07, 2026
Viaarxiv icon

Learning from Medical Entity Trees: An Entity-Centric Medical Data Engineering Framework for MLLMs

Add code
Apr 28, 2026
Viaarxiv icon

HieraVid: Hierarchical Token Pruning for Fast Video Large Language Models

Add code
Apr 02, 2026
Viaarxiv icon

StereoVGGT: A Training-Free Visual Geometry Transformer for Stereo Vision

Add code
Mar 31, 2026
Viaarxiv icon