Picture for Yunpeng Chen

Yunpeng Chen

ARM: An AutoRegressive Large Multimodal Model with Unified Discrete Representations

Add code
Jun 09, 2026
Viaarxiv icon

Enhancing Spatial Understanding in Image Generation via Reward Modeling

Add code
Feb 27, 2026
Viaarxiv icon

CharaConsist: Fine-Grained Consistent Character Generation

Add code
Jul 15, 2025
Figure 1 for CharaConsist: Fine-Grained Consistent Character Generation
Figure 2 for CharaConsist: Fine-Grained Consistent Character Generation
Figure 3 for CharaConsist: Fine-Grained Consistent Character Generation
Figure 4 for CharaConsist: Fine-Grained Consistent Character Generation
Viaarxiv icon

Mix-of-Show: Decentralized Low-Rank Adaptation for Multi-Concept Customization of Diffusion Models

Add code
May 29, 2023
Viaarxiv icon

Distribution-Aware Single-Stage Models for Multi-Person 3D Pose Estimation

Add code
Mar 23, 2022
Figure 1 for Distribution-Aware Single-Stage Models for Multi-Person 3D Pose Estimation
Figure 2 for Distribution-Aware Single-Stage Models for Multi-Person 3D Pose Estimation
Figure 3 for Distribution-Aware Single-Stage Models for Multi-Person 3D Pose Estimation
Figure 4 for Distribution-Aware Single-Stage Models for Multi-Person 3D Pose Estimation
Viaarxiv icon

SODAR: Segmenting Objects by DynamicallyAggregating Neighboring Mask Representations

Add code
Feb 15, 2022
Viaarxiv icon

MorphMLP: A Self-Attention Free, MLP-Like Backbone for Image and Video

Add code
Nov 24, 2021
Figure 1 for MorphMLP: A Self-Attention Free, MLP-Like Backbone for Image and Video
Figure 2 for MorphMLP: A Self-Attention Free, MLP-Like Backbone for Image and Video
Figure 3 for MorphMLP: A Self-Attention Free, MLP-Like Backbone for Image and Video
Figure 4 for MorphMLP: A Self-Attention Free, MLP-Like Backbone for Image and Video
Viaarxiv icon

Improved Pillar with Fine-grained Feature for 3D Object Detection

Add code
Oct 12, 2021
Figure 1 for Improved Pillar with Fine-grained Feature for 3D Object Detection
Figure 2 for Improved Pillar with Fine-grained Feature for 3D Object Detection
Figure 3 for Improved Pillar with Fine-grained Feature for 3D Object Detection
Figure 4 for Improved Pillar with Fine-grained Feature for 3D Object Detection
Viaarxiv icon

Dense Contrastive Visual-Linguistic Pretraining

Add code
Sep 24, 2021
Figure 1 for Dense Contrastive Visual-Linguistic Pretraining
Figure 2 for Dense Contrastive Visual-Linguistic Pretraining
Figure 3 for Dense Contrastive Visual-Linguistic Pretraining
Figure 4 for Dense Contrastive Visual-Linguistic Pretraining
Viaarxiv icon

PnP-DETR: Towards Efficient Visual Analysis with Transformers

Add code
Sep 16, 2021
Figure 1 for PnP-DETR: Towards Efficient Visual Analysis with Transformers
Figure 2 for PnP-DETR: Towards Efficient Visual Analysis with Transformers
Figure 3 for PnP-DETR: Towards Efficient Visual Analysis with Transformers
Figure 4 for PnP-DETR: Towards Efficient Visual Analysis with Transformers
Viaarxiv icon