Picture for Jing Xiao

Jing Xiao

SA-GEM: Scale-Adaptive and Geospatial Evidence-Modulated Token Pruning for Efficient Remote Sensing Large Vision-Language Models

Add code
Aug 15, 2026
Viaarxiv icon

LongEarth-R1: Benchmarking and Aligning Vision-Language Models for Long-Horizon Earth Observation Reasoning

Add code
Aug 13, 2026
Viaarxiv icon

Developing Combined Manipulation and Locomotion Skills with Interaction Representation and Skill Composition

Add code
Jul 31, 2026
Viaarxiv icon

GeoMamba: A Geometry-driven MambaVision Framework and Dataset for Fine-grained Optical-SAR Object Retrieval

Add code
May 19, 2026
Viaarxiv icon

Open-Vocabulary Semantic Segmentation Network Integrating Object-Level Label and Scene-Level Semantic Features for Multimodal Remote Sensing Images

Add code
Apr 27, 2026
Viaarxiv icon

Behavior-Aware Dual-Channel Preference Learning for Heterogeneous Sequential Recommendation

Add code
Apr 16, 2026
Viaarxiv icon

Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models

Add code
Apr 13, 2026
Viaarxiv icon

Observe Less, Understand More: Cost-aware Cross-scale Observation for Remote Sensing Understanding

Add code
Apr 13, 2026
Viaarxiv icon

CAGMamba: Context-Aware Gated Cross-Modal Mamba Network for Multimodal Sentiment Analysis

Add code
Apr 04, 2026
Viaarxiv icon

PReD: An LLM-based Foundation Multimodal Model for Electromagnetic Perception, Recognition, and Decision

Add code
Apr 01, 2026
Viaarxiv icon