Picture for Yichen Zhu

Yichen Zhu

IMUG-Bench: Benchmarking Unified Multimodal Models on Interleaved Understanding and Generation

Add code
Jun 08, 2026
Viaarxiv icon

ActiveMimic: Egocentric Video Pretraining with Active Perception

Add code
Jun 04, 2026
Viaarxiv icon

dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Model

Add code
Apr 24, 2026
Viaarxiv icon

Hi-WM: Human-in-the-World-Model for Scalable Robot Post-Training

Add code
Apr 23, 2026
Viaarxiv icon

Drive-KD: Multi-Teacher Distillation for VLMs in Autonomous Driving

Add code
Jan 29, 2026
Viaarxiv icon

AutoDriDM: An Explainable Benchmark for Decision-Making of Vision-Language Models in Autonomous Driving

Add code
Jan 21, 2026
Viaarxiv icon

Let Me Show You: Learning by Retrieving from Egocentric Video for Robotic Manipulation

Add code
Nov 07, 2025
Viaarxiv icon

ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations

Add code
Oct 02, 2025
Figure 1 for ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations
Figure 2 for ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations
Figure 3 for ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations
Figure 4 for ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations
Viaarxiv icon

"Pull or Not to Pull?'': Investigating Moral Biases in Leading Large Language Models Across Ethical Dilemmas

Add code
Aug 10, 2025
Viaarxiv icon

Active Multimodal Distillation for Few-shot Action Recognition

Add code
Jun 16, 2025
Figure 1 for Active Multimodal Distillation for Few-shot Action Recognition
Figure 2 for Active Multimodal Distillation for Few-shot Action Recognition
Figure 3 for Active Multimodal Distillation for Few-shot Action Recognition
Figure 4 for Active Multimodal Distillation for Few-shot Action Recognition
Viaarxiv icon