Picture for Xihui Liu

Xihui Liu

Boogu-Image-0.1: Boosting Open-Source Unified Multimodal Understanding and Generation

Add code
Jul 14, 2026
Viaarxiv icon

UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks

Add code
Jul 09, 2026
Viaarxiv icon

G$^2$TAM: Geometry Grounded Track Anything Model

Add code
Jul 04, 2026
Viaarxiv icon

MemLearner: Learning to Query Context memory for Video World Models

Add code
Jun 30, 2026
Viaarxiv icon

Translation as a Bridging Action: Transferring Manipulation Skills from Humans to Robots

Add code
Jun 26, 2026
Viaarxiv icon

Making Foresight Actionable: Repurposing Representation Alignment in World Action Models

Add code
Jun 10, 2026
Viaarxiv icon

Thinking with Imagination: Agentic Visual Spatial Reasoning with World Simulators

Add code
Jun 04, 2026
Viaarxiv icon

LithoGRPO: Fast Inverse Lithography via GRPO Reinforced Flow Matching

Add code
May 29, 2026
Viaarxiv icon

Representation Forcing for Bottleneck-Free Unified Multimodal Models

Add code
May 29, 2026
Viaarxiv icon

MSAVBench: Towards Comprehensive and Reliable Evaluation of Multi-Shot Audio-Video Generation

Add code
May 19, 2026
Viaarxiv icon