Picture for Chen-Wei Xie

Chen-Wei Xie

Video = World + Event Stream

Add code
Jul 16, 2026
Viaarxiv icon

Wan-Streamer v0.2: Higher Resolution, Same Latency

Add code
Jul 05, 2026
Viaarxiv icon

Wan-Streamer v0.1: End-to-end Real-time Interactive Foundation Models

Add code
Jun 25, 2026
Viaarxiv icon

Wan-Image: Pushing the Boundaries of Generative Visual Intelligence

Add code
Apr 21, 2026
Viaarxiv icon

AIBench: Evaluating Visual-Logical Consistency in Academic Illustration Generation

Add code
Mar 31, 2026
Viaarxiv icon

GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning

Add code
Jan 26, 2026
Viaarxiv icon

ShowTable: Unlocking Creative Table Visualization with Collaborative Reflection and Refinement

Add code
Dec 15, 2025
Viaarxiv icon

Aligned Better, Listen Better for Audio-Visual Large Language Models

Add code
Apr 02, 2025
Figure 1 for Aligned Better, Listen Better for Audio-Visual Large Language Models
Figure 2 for Aligned Better, Listen Better for Audio-Visual Large Language Models
Figure 3 for Aligned Better, Listen Better for Audio-Visual Large Language Models
Figure 4 for Aligned Better, Listen Better for Audio-Visual Large Language Models
Viaarxiv icon

Wan: Open and Advanced Large-Scale Video Generative Models

Add code
Mar 26, 2025
Figure 1 for Wan: Open and Advanced Large-Scale Video Generative Models
Figure 2 for Wan: Open and Advanced Large-Scale Video Generative Models
Figure 3 for Wan: Open and Advanced Large-Scale Video Generative Models
Figure 4 for Wan: Open and Advanced Large-Scale Video Generative Models
Viaarxiv icon

Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models

Add code
Mar 20, 2025
Viaarxiv icon