Picture for Jiajun Wu

Jiajun Wu

Masked Visual Actions for Unified World Modeling

Add code
Jul 21, 2026
Viaarxiv icon

LOTAPO: Leave-One-Turn Attribution for Self-Generated Process Rewards in Multi-Turn Search Reasoning

Add code
Jul 16, 2026
Viaarxiv icon

A vision foundation model for single-cell biology via spatial gene cartography

Add code
Jul 15, 2026
Viaarxiv icon

APIVOT: Adaptive Planning with Interleaved Vision-Language Thoughts

Add code
Jul 09, 2026
Viaarxiv icon

HarmVideoBench: Benchmarking Harmful Video Understanding in Large Multimodal Models

Add code
Jun 25, 2026
Viaarxiv icon

VPA-Guard: Defending and Benchmarking Image-to-Video Generation Against Visual Prompt Attacks

Add code
Jun 24, 2026
Viaarxiv icon

CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation

Add code
Jun 24, 2026
Viaarxiv icon

InSight: Self-Guided Skill Acquisition via Steerable VLAs

Add code
Jun 23, 2026
Viaarxiv icon

LoopCoder-v2: Only Loop Once for Efficient Test-Time Computation Scaling

Add code
Jun 16, 2026
Viaarxiv icon

DIRECT: When and Where Should You Allocate Test-Time Compute in Embodied Planners?

Add code
Jun 10, 2026
Viaarxiv icon