Picture for Haoyu Wu

Haoyu Wu

CoEvoKG: Co-Evolving Knowledge Graphs with Self-Evolving Search Agents

Add code
Aug 03, 2026
Viaarxiv icon

Self-Play Meets Skill Evolution: Self-Evolving Search Agents that Pose, Solve, and Remember

Add code
Jul 31, 2026
Viaarxiv icon

VideoCoCo: Code-as-CoT for Physically-Consistent Video Generation via an Agentic Dual-Engine System

Add code
Jul 29, 2026
Viaarxiv icon

OmniGF: A Dual-Branch Vision-Language Framework for Unified Gaze Following

Add code
May 26, 2026
Viaarxiv icon

ForeSplat: Optimization-Aware Foresight for Feed-Forward 3D Gaussian Splatting

Add code
May 21, 2026
Viaarxiv icon

MultiWorld: Scalable Multi-Agent Multi-View Video World Models

Add code
Apr 21, 2026
Viaarxiv icon

Learning 3D Reconstruction with Priors in Test Time

Add code
Apr 04, 2026
Viaarxiv icon

Oedipus and the Sphinx: Benchmarking and Improving Visual Language Models for Complex Graphic Reasoning

Add code
Aug 01, 2025
Figure 1 for Oedipus and the Sphinx: Benchmarking and Improving Visual Language Models for Complex Graphic Reasoning
Figure 2 for Oedipus and the Sphinx: Benchmarking and Improving Visual Language Models for Complex Graphic Reasoning
Figure 3 for Oedipus and the Sphinx: Benchmarking and Improving Visual Language Models for Complex Graphic Reasoning
Figure 4 for Oedipus and the Sphinx: Benchmarking and Improving Visual Language Models for Complex Graphic Reasoning
Viaarxiv icon

Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling

Add code
Jul 10, 2025
Viaarxiv icon

DualTalk: Dual-Speaker Interaction for 3D Talking Head Conversations

Add code
May 26, 2025
Viaarxiv icon