Picture for Wenbo Li

Wenbo Li

PROGRESS: Coverage-guided RL to Train Search-augmented LLM Agent

Add code
Aug 02, 2026
Viaarxiv icon

Role-Break in Attention Heads: Understanding and Detecting Hallucinations in VLMs

Add code
Jul 31, 2026
Viaarxiv icon

Geo3R: Mitigating Spatial Reasoning Hallucination in Multimodal Large Language Models

Add code
Jul 23, 2026
Viaarxiv icon

HalluScope: Fine-grained Hallucination Diagnosis for Multimodal Large Language Models

Add code
Jul 23, 2026
Viaarxiv icon

CoDMD: Copula-aware Distribution Matching Distillation for Fast Video Generation

Add code
Jun 20, 2026
Viaarxiv icon

PathRouter: Aligning Rewards with Retrieval Quality in Agentic Graph Retrieval-Augmented Generation

Add code
Jun 15, 2026
Viaarxiv icon

Doc-to-Atom: Learning to Compile and Compose Memory Atoms

Add code
Jun 10, 2026
Viaarxiv icon

SpatialWorld: Benchmarking Interactive Spatial Reasoning of Multimodal Agents in Real-World Tasks

Add code
Jun 08, 2026
Viaarxiv icon

HomeWorld: A Unified Floorplan-to-Furnished Framework for Generating Controllable, Densely Interactive Whole-Home Scenes

Add code
Jun 04, 2026
Viaarxiv icon

Fast Image Super-Resolution via Consistency Rectified Flow

Add code
May 12, 2026
Viaarxiv icon