Picture for Heng Qu

Heng Qu

Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories

Add code
Jul 22, 2026
Viaarxiv icon

Mi-Memory: A Lifecycle Memory Framework for Personal AI

Add code
Jul 21, 2026
Viaarxiv icon

Xiaomi-Robotics-U0: Unified Embodied Synthesis with World Foundation Model

Add code
Jul 13, 2026
Viaarxiv icon

Xiaomi-GUI-0 Technical Report

Add code
Jul 01, 2026
Viaarxiv icon

HarnessX: A Composable, Adaptive, and Evolvable Agent Harness Foundry

Add code
Jun 12, 2026
Viaarxiv icon

Scaling, Benchmarking, and Reasoning of Vision-Language Agents for Mobile GUI Navigation

Add code
May 26, 2026
Viaarxiv icon

How Mobile World Model Guides GUI Agents?

Add code
May 11, 2026
Viaarxiv icon

Xiaomi-Robotics-0: An Open-Sourced Vision-Language-Action Model with Real-Time Execution

Add code
Feb 13, 2026
Viaarxiv icon

MiMo-V2-Flash Technical Report

Add code
Jan 08, 2026
Viaarxiv icon

MiMo-Audio: Audio Language Models are Few-Shot Learners

Add code
Dec 29, 2025
Viaarxiv icon