Picture for Xiang Deng

Xiang Deng

Mark

Hermite Curves as Trajectory Priors for Vision-Language-Action Models

Add code
Aug 02, 2026
Viaarxiv icon

How to Build Digital Humans? From Priors to Photorealistic Avatars

Add code
Jul 05, 2026
Viaarxiv icon

Technical Report of RoboSpatial Challenge at CVPR 2026: Selective Reasoning Activation and Reference-Frame Disambiguation for Embodied Spatial Reasoning

Add code
Jun 30, 2026
Viaarxiv icon

Efficient Visual Pointing for Embodied AI:Agent-Driven Data Synthesis, Cross-Block Attention, and Iterative Correction

Add code
Jun 29, 2026
Viaarxiv icon

Beyond Waypoints: A Trajectory-Centric Waypointing Paradigm for Vision-Language Navigation

Add code
Jun 05, 2026
Viaarxiv icon

Cortical Policy: A Dual-Stream View Transformer for Robotic Manipulation

Add code
Mar 22, 2026
Viaarxiv icon

U-Mind: A Unified Framework for Real-Time Multimodal Interaction with Audiovisual Generation

Add code
Feb 27, 2026
Viaarxiv icon

GeoDiff4D: Geometry-Aware Diffusion for 4D Head Avatar Reconstruction

Add code
Feb 27, 2026
Viaarxiv icon

Imitation Learning for Multi-turn LM Agents via On-policy Expert Corrections

Add code
Dec 16, 2025
Figure 1 for Imitation Learning for Multi-turn LM Agents via On-policy Expert Corrections
Figure 2 for Imitation Learning for Multi-turn LM Agents via On-policy Expert Corrections
Figure 3 for Imitation Learning for Multi-turn LM Agents via On-policy Expert Corrections
Figure 4 for Imitation Learning for Multi-turn LM Agents via On-policy Expert Corrections
Viaarxiv icon

Task-Aware 3D Affordance Segmentation via 2D Guidance and Geometric Refinement

Add code
Nov 12, 2025
Viaarxiv icon