Picture for Xiaodong Xie

Xiaodong Xie

Group-of-Latents: Perceptual Video Compression at Extreme Bitrates via Masked Latent Generative Modeling

Add code
Jul 21, 2026
Viaarxiv icon

A Tri-Dynamic Preprocessing Framework for UGC Video Compression

Add code
Dec 18, 2025
Figure 1 for A Tri-Dynamic Preprocessing Framework for UGC Video Compression
Figure 2 for A Tri-Dynamic Preprocessing Framework for UGC Video Compression
Figure 3 for A Tri-Dynamic Preprocessing Framework for UGC Video Compression
Figure 4 for A Tri-Dynamic Preprocessing Framework for UGC Video Compression
Viaarxiv icon

A Preprocessing Framework for Video Machine Vision under Compression

Add code
Dec 17, 2025
Figure 1 for A Preprocessing Framework for Video Machine Vision under Compression
Figure 2 for A Preprocessing Framework for Video Machine Vision under Compression
Figure 3 for A Preprocessing Framework for Video Machine Vision under Compression
Figure 4 for A Preprocessing Framework for Video Machine Vision under Compression
Viaarxiv icon

FM-OV3D: Foundation Model-based Cross-modal Knowledge Blending for Open-Vocabulary 3D Detection

Add code
Dec 22, 2023
Figure 1 for FM-OV3D: Foundation Model-based Cross-modal Knowledge Blending for Open-Vocabulary 3D Detection
Figure 2 for FM-OV3D: Foundation Model-based Cross-modal Knowledge Blending for Open-Vocabulary 3D Detection
Figure 3 for FM-OV3D: Foundation Model-based Cross-modal Knowledge Blending for Open-Vocabulary 3D Detection
Figure 4 for FM-OV3D: Foundation Model-based Cross-modal Knowledge Blending for Open-Vocabulary 3D Detection
Viaarxiv icon

COLE: A Hierarchical Generation Framework for Graphic Design

Add code
Nov 28, 2023
Viaarxiv icon

PM-DETR: Domain Adaptive Prompt Memory for Object Detection with Transformers

Add code
Jul 01, 2023
Viaarxiv icon

Open-Vocabulary Point-Cloud Object Detection without 3D Annotation

Add code
Apr 03, 2023
Figure 1 for Open-Vocabulary Point-Cloud Object Detection without 3D Annotation
Figure 2 for Open-Vocabulary Point-Cloud Object Detection without 3D Annotation
Figure 3 for Open-Vocabulary Point-Cloud Object Detection without 3D Annotation
Figure 4 for Open-Vocabulary Point-Cloud Object Detection without 3D Annotation
Viaarxiv icon

Towards Blind Watermarking: Combining Invertible and Non-invertible Mechanisms

Add code
Dec 24, 2022
Figure 1 for Towards Blind Watermarking: Combining Invertible and Non-invertible Mechanisms
Figure 2 for Towards Blind Watermarking: Combining Invertible and Non-invertible Mechanisms
Figure 3 for Towards Blind Watermarking: Combining Invertible and Non-invertible Mechanisms
Figure 4 for Towards Blind Watermarking: Combining Invertible and Non-invertible Mechanisms
Viaarxiv icon

Multi-Agent Automated Machine Learning

Add code
Oct 17, 2022
Figure 1 for Multi-Agent Automated Machine Learning
Figure 2 for Multi-Agent Automated Machine Learning
Figure 3 for Multi-Agent Automated Machine Learning
Figure 4 for Multi-Agent Automated Machine Learning
Viaarxiv icon

Open-Vocabulary 3D Detection via Image-level Class and Debiased Cross-modal Contrastive Learning

Add code
Jul 05, 2022
Figure 1 for Open-Vocabulary 3D Detection via Image-level Class and Debiased Cross-modal Contrastive Learning
Figure 2 for Open-Vocabulary 3D Detection via Image-level Class and Debiased Cross-modal Contrastive Learning
Figure 3 for Open-Vocabulary 3D Detection via Image-level Class and Debiased Cross-modal Contrastive Learning
Figure 4 for Open-Vocabulary 3D Detection via Image-level Class and Debiased Cross-modal Contrastive Learning
Viaarxiv icon