Picture for Weihao Yuan

Weihao Yuan

Data Pyramid for Embodied Manipulation

Add code
Jul 27, 2026
Viaarxiv icon

Glob3R: Global Structure-from-Motion with 3D Foundation Models

Add code
Jul 10, 2026
Viaarxiv icon

UniTacVLA: Unified Tactile Understanding and Prediction in Vision Language Action Models

Add code
Jun 30, 2026
Viaarxiv icon

TouchThinker: Scaling Tactile Commonsense Reasoning to the Open World with Large-scale Data and Action-aware Representation

Add code
Jun 10, 2026
Viaarxiv icon

3DThinkVLA: Endowing Vision-Language-Action Models with Latent 3D Priors via 3D-Thinking-Guided Co-training

Add code
Jun 03, 2026
Viaarxiv icon

Touch-R1: Reinforcing Touch Reasoning in MLLMs

Add code
May 26, 2026
Viaarxiv icon

FocusVLA: Focused Visual Utilization for Vision-Language-Action Models

Add code
Mar 30, 2026
Viaarxiv icon

ViSA: 3D-Aware Video Shading for Real-Time Upper-Body Avatar Creation

Add code
Dec 09, 2025
Figure 1 for ViSA: 3D-Aware Video Shading for Real-Time Upper-Body Avatar Creation
Figure 2 for ViSA: 3D-Aware Video Shading for Real-Time Upper-Body Avatar Creation
Figure 3 for ViSA: 3D-Aware Video Shading for Real-Time Upper-Body Avatar Creation
Figure 4 for ViSA: 3D-Aware Video Shading for Real-Time Upper-Body Avatar Creation
Viaarxiv icon

OmniMotion: Multimodal Motion Generation with Continuous Masked Autoregression

Add code
Oct 16, 2025
Figure 1 for OmniMotion: Multimodal Motion Generation with Continuous Masked Autoregression
Figure 2 for OmniMotion: Multimodal Motion Generation with Continuous Masked Autoregression
Figure 3 for OmniMotion: Multimodal Motion Generation with Continuous Masked Autoregression
Figure 4 for OmniMotion: Multimodal Motion Generation with Continuous Masked Autoregression
Viaarxiv icon

PanoLAM: Large Avatar Model for Gaussian Full-Head Synthesis from One-shot Unposed Image

Add code
Sep 09, 2025
Figure 1 for PanoLAM: Large Avatar Model for Gaussian Full-Head Synthesis from One-shot Unposed Image
Figure 2 for PanoLAM: Large Avatar Model for Gaussian Full-Head Synthesis from One-shot Unposed Image
Figure 3 for PanoLAM: Large Avatar Model for Gaussian Full-Head Synthesis from One-shot Unposed Image
Figure 4 for PanoLAM: Large Avatar Model for Gaussian Full-Head Synthesis from One-shot Unposed Image
Viaarxiv icon