Picture for Zheng Wei

Zheng Wei

LUT: Latent Utility Training for Visual Reasoning

Add code
Aug 01, 2026
Viaarxiv icon

Thinking in Video: Can Video Generators Really Reason About the Real World?

Add code
Jul 20, 2026
Viaarxiv icon

ProLaViT: Learning Progressive Latent Visual Thoughts in Structured Latent Space

Add code
Jul 03, 2026
Viaarxiv icon

Focus When Necessary: Adaptive Routing and Collaborative Grounding for Training-Free Visual Grounding

Add code
Jun 15, 2026
Viaarxiv icon

Conan-embedding-v3: Fusing Modality-Specific Models for Omni-Modal Embedding

Add code
Jun 08, 2026
Viaarxiv icon

Exploring Autonomous Agentic Data Engineering for Model Specialization

Add code
May 28, 2026
Viaarxiv icon

KVServe: Service-Aware KV Cache Compression for Communication-Efficient Disaggregated LLM Serving

Add code
May 13, 2026
Viaarxiv icon

FIS-DiT: Breaking the Few-Step Video Inference Barrier via Training-Free Frame Interleaved Sparsity

Add code
May 12, 2026
Viaarxiv icon

TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training

Add code
Apr 27, 2026
Viaarxiv icon

Hybrid Latent Reasoning with Decoupled Policy Optimization

Add code
Apr 22, 2026
Viaarxiv icon