Picture for Xiaomeng Zhu

Xiaomeng Zhu

RxBrain: Embodied Cognition Foundation Model with Joint Language-Visual Reasoning and Imagination

Add code
Jul 15, 2026
Viaarxiv icon

Plan Right, Then Plan Tight: Symbolic RL for Efficient Embodied Reasoning

Add code
Jun 30, 2026
Viaarxiv icon

SynFlow: Scaling Up LiDAR Scene Flow Estimation with Synthetic Data

Add code
Apr 10, 2026
Viaarxiv icon

Listening with the Eyes: Benchmarking Egocentric Co-Speech Grounding across Space and Time

Add code
Mar 09, 2026
Viaarxiv icon

TeFlow: Enabling Multi-frame Supervision for Self-Supervised Feed-forward Scene Flow Estimation

Add code
Feb 22, 2026
Viaarxiv icon

ProAct: A Benchmark and Multimodal Framework for Structure-Aware Proactive Response

Add code
Feb 03, 2026
Viaarxiv icon

DeltaFlow: An Efficient Multi-frame Scene Flow Estimation Method

Add code
Aug 23, 2025
Figure 1 for DeltaFlow: An Efficient Multi-frame Scene Flow Estimation Method
Figure 2 for DeltaFlow: An Efficient Multi-frame Scene Flow Estimation Method
Figure 3 for DeltaFlow: An Efficient Multi-frame Scene Flow Estimation Method
Figure 4 for DeltaFlow: An Efficient Multi-frame Scene Flow Estimation Method
Viaarxiv icon

The Structural Sources of Verb Meaning Revisited: Large Language Models Display Syntactic Bootstrapping

Add code
Aug 17, 2025
Viaarxiv icon

Domain Randomization for Object Detection in Manufacturing Applications using Synthetic Data: A Comprehensive Study

Add code
Jun 09, 2025
Viaarxiv icon

Afford-X: Generalizable and Slim Affordance Reasoning for Task-oriented Manipulation

Add code
Mar 05, 2025
Viaarxiv icon