Picture for Xianbiao Qi

Xianbiao Qi

Evolve Vision-Language-Action Model into an Agent with On-the-fly Tool-use

Add code
Aug 14, 2026
Viaarxiv icon

ScaleVid: Geometry-Aware Video Object Scaling with Mesh-Free Inference

Add code
Aug 12, 2026
Viaarxiv icon

Multi-Modal Representation Learning via Semi-Supervised Rate Reduction for Generalized Category Discovery

Add code
Feb 23, 2026
Viaarxiv icon

Ctrl&Shift: High-Quality Geometry-Aware Object Manipulation in Visual Generation

Add code
Feb 11, 2026
Viaarxiv icon

Open-Text Aerial Detection: A Unified Framework For Aerial Visual Grounding And Detection

Add code
Feb 08, 2026
Viaarxiv icon

Delving into Muon and Beyond: Deep Analysis and Extensions

Add code
Feb 04, 2026
Viaarxiv icon

SimpleGPT: Improving GPT via A Simple Normalization Strategy

Add code
Feb 01, 2026
Viaarxiv icon

Double Helix Diffusion for Cross-Domain Anomaly Image Generation

Add code
Sep 16, 2025
Viaarxiv icon

DNT: a Deeply Normalized Transformer that can be trained by Momentum SGD

Add code
Jul 23, 2025
Viaarxiv icon

MiniMax-Remover: Taming Bad Noise Helps Video Object Removal

Add code
May 30, 2025
Viaarxiv icon