Picture for Chun Yu

Chun Yu

UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on

Add code
Aug 06, 2026
Viaarxiv icon

PAGE: Towards Practical Human-level Gaze Target Estimation

Add code
Jul 06, 2026
Viaarxiv icon

AA: A Multi-view Multimodal Dataset for Screen-based Gaze Estimation

Add code
Jun 30, 2026
Viaarxiv icon

HiSync: Spatio-Temporally Aligning Hand Motion from Wearable IMU and On-Robot Camera for Command Source Identification in Long-Range HRI

Add code
Mar 12, 2026
Viaarxiv icon

Multivariate Diffusion Transformer with Decoupled Attention for High-Fidelity Mask-Text Collaborative Facial Generation

Add code
Nov 16, 2025
Viaarxiv icon

TaskSense: Cognitive Chain Modeling and Difficulty Estimation for GUI Tasks

Add code
Nov 12, 2025
Figure 1 for TaskSense: Cognitive Chain Modeling and Difficulty Estimation for GUI Tasks
Figure 2 for TaskSense: Cognitive Chain Modeling and Difficulty Estimation for GUI Tasks
Figure 3 for TaskSense: Cognitive Chain Modeling and Difficulty Estimation for GUI Tasks
Figure 4 for TaskSense: Cognitive Chain Modeling and Difficulty Estimation for GUI Tasks
Viaarxiv icon

TextOnly: A Unified Function Portal for Text-Related Functions on Smartphones

Add code
Aug 23, 2025
Viaarxiv icon

MOAT: Evaluating LMMs for Capability Integration and Instruction Grounding

Add code
Mar 12, 2025
Viaarxiv icon

PoseAugment: Generative Human Pose Data Augmentation with Physical Plausibility for IMU-based Motion Capture

Add code
Sep 21, 2024
Viaarxiv icon

G-VOILA: Gaze-Facilitated Information Querying in Daily Scenarios

Add code
May 13, 2024
Viaarxiv icon