Picture for Zelin Zhao

Zelin Zhao

SWE-Bench ProMax: Benchmarking Agents on Large-Scale Multilingual Code Refactoring

Add code
Aug 10, 2026
Viaarxiv icon

Point as Skeleton: Accumulated Point Cloud Enhanced Autoregressive Generation for Closed-Loop Autonomous Driving Simulation

Add code
Jul 07, 2026
Viaarxiv icon

WorldBagel: Uncovering the Power of Unified Multimodal Models for Vision-Language-Action-World Modeling

Add code
Jul 03, 2026
Viaarxiv icon

Laplacian Multi-scale Flow Matching for Generative Modeling

Add code
Feb 23, 2026
Viaarxiv icon

ERNIE 5.0 Technical Report

Add code
Feb 04, 2026
Viaarxiv icon

Clarify Before You Draw: Proactive Agents for Robust Text-to-CAD Generation

Add code
Feb 03, 2026
Viaarxiv icon

MV-S2V: Multi-View Subject-Consistent Video Generation

Add code
Jan 27, 2026
Viaarxiv icon

PhyAVBench: A Challenging Audio Physics-Sensitivity Benchmark for Physically Grounded Text-to-Audio-Video Generation

Add code
Dec 30, 2025
Viaarxiv icon

ByteLoom: Weaving Geometry-Consistent Human-Object Interactions through Progressive Curriculum Learning

Add code
Dec 28, 2025
Viaarxiv icon

CETCAM: Camera-Controllable Video Generation via Consistent and Extensible Tokenization

Add code
Dec 22, 2025
Figure 1 for CETCAM: Camera-Controllable Video Generation via Consistent and Extensible Tokenization
Figure 2 for CETCAM: Camera-Controllable Video Generation via Consistent and Extensible Tokenization
Figure 3 for CETCAM: Camera-Controllable Video Generation via Consistent and Extensible Tokenization
Figure 4 for CETCAM: Camera-Controllable Video Generation via Consistent and Extensible Tokenization
Viaarxiv icon