Picture for Ruichuan An

Ruichuan An

VideoCoCo: Code-as-CoT for Physically-Consistent Video Generation via an Agentic Dual-Engine System

Add code
Jul 29, 2026
Viaarxiv icon

SteerVTE: Seamless Video Text Editing with Style and Glyph Control

Add code
Jun 22, 2026
Viaarxiv icon

Agent Skills Should Go Beyond Text: The Case for Visual Skills

Add code
May 31, 2026
Viaarxiv icon

Rethinking VLM Representation for VLA Initialization

Add code
May 25, 2026
Viaarxiv icon

VGGT-Edit: Feed-forward Native 3D Scene Editing with Residual Field Prediction

Add code
May 14, 2026
Viaarxiv icon

Uni-Synergy: Bridging Understanding and Generation for Personalized Reasoning via Co-operative Reinforcement Learning

Add code
May 11, 2026
Viaarxiv icon

OpenWorldLib: A Unified Codebase and Definition of Advanced World Models

Add code
Apr 06, 2026
Viaarxiv icon

DataFlex: A Unified Framework for Data-Centric Dynamic Training of Large Language Models

Add code
Mar 27, 2026
Viaarxiv icon

MME-CoF-Pro: Evaluating Reasoning Coherence in Video Generative Models with Text and Visual Hints

Add code
Mar 20, 2026
Viaarxiv icon

PEARL: Personalized Streaming Video Understanding Model

Add code
Mar 20, 2026
Viaarxiv icon