Picture for Shaohui Liu

Shaohui Liu

PolyLayout: Multi-room Manhattan Layout Estimation

Add code
Aug 04, 2026
Viaarxiv icon

Full-Pipeline Inference Optimization for MiMo-V2.5 Series: Pushing Hybrid SWA Efficiency to the Limit

Add code
Jul 14, 2026
Viaarxiv icon

Vision Pretraining for Dense Spatial Perception

Add code
Jul 06, 2026
Viaarxiv icon

Dual-Path Hyperprior Informed Deep Unfolding Network for Image Compressive Sensing

Add code
May 10, 2026
Viaarxiv icon

MiMo-V2-Flash Technical Report

Add code
Jan 08, 2026
Viaarxiv icon

MiMo-Audio: Audio Language Models are Few-Shot Learners

Add code
Dec 29, 2025
Viaarxiv icon

Benchmarking Egocentric Visual-Inertial SLAM at City Scale

Add code
Sep 30, 2025
Viaarxiv icon

Segmenting and Understanding: Region-aware Semantic Attention for Fine-grained Image Quality Assessment with Large Language Models

Add code
Aug 11, 2025
Viaarxiv icon

Q-CLIP: Unleashing the Power of Vision-Language Models for Video Quality Assessment through Unified Cross-Modal Adaptation

Add code
Aug 08, 2025
Viaarxiv icon

UGD-IML: A Unified Generative Diffusion-based Framework for Constrained and Unconstrained Image Manipulation Localization

Add code
Aug 08, 2025
Viaarxiv icon