Picture for Wenjun Zeng

Wenjun Zeng

MMOOC: A Comprehensive Benchmark for Out-of-Context Evaluation in Multimodal Large Language Models

Add code
Jul 30, 2026
Viaarxiv icon

RPG-VST: Robust Poisson-Gaussian Variance Stabilization for Blind RAW Denoising

Add code
Jul 27, 2026
Viaarxiv icon

GEM-Occ: From Visual Geometry Evidence to Embodied Semantic Occupancy Memory

Add code
Jul 06, 2026
Viaarxiv icon

Bridging 3D Gaussians and Semantic Occupancy for Comprehensive Open-Vocabulary Scene Understanding from Unposed Images

Add code
Jul 02, 2026
Viaarxiv icon

DeformGen: Dynamics-Based Topology Augmentation for Deformable Manipulation Policy Learning

Add code
Jun 24, 2026
Viaarxiv icon

Dual Distribution Estimation for Zero-shot Noisy Test-Time Adaptation with VLMs

Add code
Jun 24, 2026
Viaarxiv icon

ImageWAM: Do World Action Models Really Need Video Generation, or Just Image Editing?

Add code
Jun 17, 2026
Viaarxiv icon

Proprioceptive-visual correspondence enables self-other distinction in humanoid robots

Add code
Jun 11, 2026
Viaarxiv icon

Can VLA Models Learn from Real-World Data Continually without Forgetting?

Add code
May 26, 2026
Viaarxiv icon

ProEval: Proactive Failure Discovery and Efficient Performance Estimation for Generative AI Evaluation

Add code
Apr 25, 2026
Viaarxiv icon