Picture for Yiming Zhong

Yiming Zhong

KeyID: Decoupled Drafting and Keyframe Editing for Identity-Preserving Video Generation

Add code
Aug 17, 2026
Viaarxiv icon

Omni-Prune: Query-Aware Unified Token Pruning for Efficient Omnimodal Large Language Models

Add code
Jul 26, 2026
Viaarxiv icon

Global Logic and Local Search: Dual-Stream Multimodal In-Context Learning for Verifiable Industrial Anomaly Detection

Add code
Jul 04, 2026
Viaarxiv icon

Implicit Drifting Policy: One-Step Action Generation via Conditional Expert Geometry

Add code
May 31, 2026
Viaarxiv icon

From Noise to Intent: Anchoring Generative VLA Policies with Residual Bridges

Add code
Apr 23, 2026
Viaarxiv icon

FastGrasp: Learning-based Whole-body Control method for Fast Dexterous Grasping with Mobile Manipulators

Add code
Apr 14, 2026
Viaarxiv icon

VideoAfford: Grounding 3D Affordance from Human-Object-Interaction Videos via Multimodal Large Language Model

Add code
Feb 10, 2026
Viaarxiv icon

Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model

Add code
Aug 08, 2025
Viaarxiv icon

AvatarMakeup: Realistic Makeup Transfer for 3D Animatable Head Avatars

Add code
Jul 03, 2025
Viaarxiv icon

EvolvingGrasp: Evolutionary Grasp Generation via Efficient Preference Alignment

Add code
Mar 19, 2025
Figure 1 for EvolvingGrasp: Evolutionary Grasp Generation via Efficient Preference Alignment
Figure 2 for EvolvingGrasp: Evolutionary Grasp Generation via Efficient Preference Alignment
Figure 3 for EvolvingGrasp: Evolutionary Grasp Generation via Efficient Preference Alignment
Figure 4 for EvolvingGrasp: Evolutionary Grasp Generation via Efficient Preference Alignment
Viaarxiv icon