Picture for Peng Jia

Peng Jia

CETalk: Continuous Valence-Arousal Control for Audio-Driven 3D Talking Head Generation

Add code
Aug 15, 2026
Viaarxiv icon

Rethink Before You Execute: Adaptive Execution for World Action Models

Add code
Aug 10, 2026
Viaarxiv icon

LaST-HD: Learning Latent Physical Reasoning from Scalable Human Data for Robot Manipulation

Add code
Jun 22, 2026
Viaarxiv icon

SDTalk: Structured Facial Priors and Dual-Branch Motion Fields for Generalizable Gaussian Talking Head Synthesis

Add code
May 11, 2026
Viaarxiv icon

HarmoWAM: Harmonizing Generalizable and Precise Manipulation via Adaptive World Action Models

Add code
May 11, 2026
Viaarxiv icon

Look Before Acting: Enhancing Vision Foundation Representations for Vision-Language-Action Models

Add code
Mar 17, 2026
Viaarxiv icon

TwinRL-VLA: Digital Twin-Driven Reinforcement Learning for Real-World Robotic Manipulation

Add code
Feb 09, 2026
Viaarxiv icon

TLDiffGAN: A Latent Diffusion-GAN Framework with Temporal Information Fusion for Anomalous Sound Detection

Add code
Feb 01, 2026
Viaarxiv icon

OmniGen: Unified Multimodal Sensor Generation for Autonomous Driving

Add code
Dec 16, 2025
Viaarxiv icon

PortAgent: LLM-driven Vehicle Dispatching Agent for Port Terminals

Add code
Dec 16, 2025
Figure 1 for PortAgent: LLM-driven Vehicle Dispatching Agent for Port Terminals
Figure 2 for PortAgent: LLM-driven Vehicle Dispatching Agent for Port Terminals
Figure 3 for PortAgent: LLM-driven Vehicle Dispatching Agent for Port Terminals
Figure 4 for PortAgent: LLM-driven Vehicle Dispatching Agent for Port Terminals
Viaarxiv icon