Picture for Di Wen

Di Wen

GuideFetch: A Task Coordination Framework for Concurrent Navigation and Object Retrieval in Assistive Robot Dogs

Add code
Aug 18, 2026
Viaarxiv icon

HGeo-TopoMap: Boosting Topological Mapping with Hierarchical Geometric Priors

Add code
Jul 23, 2026
Viaarxiv icon

Hand-centric Human-to-Robot Trajectory Transfer from Video Demonstrations via Open-World Contact Localization

Add code
Jun 09, 2026
Viaarxiv icon

Seeing Together: Multi-Robot Cooperative Egocentric Spatial Reasoning with Multimodal Large Language Models

Add code
May 19, 2026
Viaarxiv icon

EgoExoMem: Cross-View Memory Reasoning over Synchronized Egocentric and Exocentric Videos

Add code
May 18, 2026
Viaarxiv icon

IMPACT-CYCLE: A Contract-Based Multi-Agent System for Claim-Level Supervisory Correction of Long-Video Semantic Memory

Add code
Apr 22, 2026
Viaarxiv icon

Rethinking Video Human-Object Interaction: Set Prediction over Time for Unified Detection and Anticipation

Add code
Apr 12, 2026
Viaarxiv icon

IMPACT: A Dataset for Multi-Granularity Human Procedural Action Understanding in Industrial Assembly

Add code
Apr 12, 2026
Viaarxiv icon

Towards Multi-Source Domain Generalization for Sleep Staging with Noisy Labels

Add code
Apr 11, 2026
Viaarxiv icon

ProOOD: Prototype-Guided Out-of-Distribution 3D Occupancy Prediction

Add code
Apr 01, 2026
Viaarxiv icon