Picture for Xingyu Zeng

Xingyu Zeng

Gradient Immunity: Null-Space Resistance to Malicious Fine-Tuning

Add code
Aug 05, 2026
Viaarxiv icon

Decoupling semantics from vision: A framework for faithful visual-text compression evaluation

Add code
Aug 03, 2026
Viaarxiv icon

Prisma-World: Camera-Controllable Multi-Agent Video World Model

Add code
Jun 08, 2026
Viaarxiv icon

ZeroSense:How Vision matters in Long Context Compression

Add code
Mar 12, 2026
Viaarxiv icon

Performance-guided Reinforced Active Learning for Object Detection

Add code
Jan 22, 2026
Viaarxiv icon

Generative Photographic Control for Scene-Consistent Video Cinematic Editing

Add code
Nov 17, 2025
Viaarxiv icon

GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning

Add code
May 22, 2025
Viaarxiv icon

ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search

Add code
Apr 15, 2025
Figure 1 for ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
Figure 2 for ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
Figure 3 for ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
Figure 4 for ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
Viaarxiv icon

GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing

Add code
Mar 13, 2025
Viaarxiv icon

PUMA: Empowering Unified MLLM with Multi-granular Visual Generation

Add code
Oct 17, 2024
Figure 1 for PUMA: Empowering Unified MLLM with Multi-granular Visual Generation
Figure 2 for PUMA: Empowering Unified MLLM with Multi-granular Visual Generation
Figure 3 for PUMA: Empowering Unified MLLM with Multi-granular Visual Generation
Figure 4 for PUMA: Empowering Unified MLLM with Multi-granular Visual Generation
Viaarxiv icon