Picture for Yuanyang Yin

Yuanyang Yin

Alaya-EVOKE: From Linear-Scaling Supervision to Endless World

Add code
Aug 13, 2026
Viaarxiv icon

AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report

Add code
Jul 20, 2026
Viaarxiv icon

AlayaWorld: Long-Horizon and Playable Video World Generation

Add code
Jul 07, 2026
Viaarxiv icon

WorldMark: A Unified Benchmark Suite for Interactive Video World Models

Add code
Apr 23, 2026
Viaarxiv icon

Helios: Real Real-Time Long Video Generation Model

Add code
Mar 04, 2026
Viaarxiv icon

Focal Guidance: Unlocking Controllability from Semantic-Weak Layers in Video Diffusion Models

Add code
Jan 12, 2026
Viaarxiv icon

MAGREF: Masked Guidance for Any-Reference Video Generation

Add code
May 29, 2025
Viaarxiv icon

Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge

Add code
Nov 25, 2024
Figure 1 for Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
Figure 2 for Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
Figure 3 for Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
Figure 4 for Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
Viaarxiv icon

Towards Precise Scaling Laws for Video Diffusion Transformers

Add code
Nov 25, 2024
Figure 1 for Towards Precise Scaling Laws for Video Diffusion Transformers
Figure 2 for Towards Precise Scaling Laws for Video Diffusion Transformers
Figure 3 for Towards Precise Scaling Laws for Video Diffusion Transformers
Figure 4 for Towards Precise Scaling Laws for Video Diffusion Transformers
Viaarxiv icon

SEA: Supervised Embedding Alignment for Token-Level Visual-Textual Integration in MLLMs

Add code
Aug 21, 2024
Viaarxiv icon