Picture for Xinyan Liu

Xinyan Liu

DyG$^2$T: Modeling Object Dynamics with 3D Gaussian Temporal-Spatial Particle Graph Transformer

Add code
Aug 19, 2026
Viaarxiv icon

Depth-Guided Video Object Counting in Crowded Scenes

Add code
Aug 06, 2026
Viaarxiv icon

The Second LoViF 2026 Challenge on Real-World All-in-One Image Restoration: Methods and Results

Add code
Jul 23, 2026
Viaarxiv icon

EmoStyle: Affective Conditioning of Style-Specialist Experts for Emotional Image Generation

Add code
Jul 11, 2026
Viaarxiv icon

Towards Accurate Emotion-Attributed Video Captioning via Fine-grained Emotion-Cause Pair Extraction

Add code
Jun 07, 2026
Viaarxiv icon

Foresee-to-Ground: From Predictive Temporal Perception to Evidence-Driven Reasoning for Video Temporal Grounding

Add code
May 21, 2026
Viaarxiv icon

STAND: Semantic Anchoring Constraint with Dual-Granularity Disambiguation for Remote Sensing Image Change Captioning

Add code
Apr 25, 2026
Viaarxiv icon

CreatiParser: Generative Image Parsing of Raster Graphic Designs into Editable Layers

Add code
Apr 21, 2026
Viaarxiv icon

GeoBrowse: A Geolocation Benchmark for Agentic Tool Use with Expert-Annotated Reasoning Traces

Add code
Apr 05, 2026
Viaarxiv icon

FACE-net: Factual Calibration and Emotion Augmentation for Retrieval-enhanced Emotional Video Captioning

Add code
Mar 18, 2026
Viaarxiv icon