Picture for Qi Zhao

Qi Zhao

SCOPE: Subspace Clustering with Online Per-Head Top-K Estimation for Sparse Video Attention

Add code
Aug 13, 2026
Viaarxiv icon

Representation Handoffs for OpenArm-Based Laboratory Mobile Manipulation

Add code
Aug 07, 2026
Viaarxiv icon

Beyond Isolation: Unlocking Reinforcement Learning Component Synergy for Sample-Efficient Continuous Control

Add code
Aug 07, 2026
Viaarxiv icon

Anti-Backdoor Coreset Selection via Cumulative Entropy

Add code
Jul 28, 2026
Viaarxiv icon

Two Sides of the Same Coin: Learning the Backdoor to Remove the Backdoor

Add code
Jul 07, 2026
Viaarxiv icon

Representation Forcing for Bottleneck-Free Unified Multimodal Models

Add code
May 29, 2026
Viaarxiv icon

VL-DPO: Vision-Language-Guided Finetuning for Preference-Aligned Autonomous Driving

Add code
May 19, 2026
Viaarxiv icon

Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models

Add code
May 12, 2026
Viaarxiv icon

RealDiffusion: Physics-informed Attention for Multi-character Storybook Generation

Add code
May 12, 2026
Viaarxiv icon

CyberCane: Neuro-Symbolic RAG for Privacy-Preserving Phishing Detection with Formal Ontology Reasoning

Add code
Apr 26, 2026
Viaarxiv icon