Picture for Shijian Wang

Shijian Wang

StreamArena: Toward Continuous, Interactive, and Long-Horizon Agentic Streaming Video Understanding

Add code
Aug 06, 2026
Viaarxiv icon

Harness-R1: Learning to Edit Executable Runtime Harnesses from Agent Failure Trajectories

Add code
Aug 03, 2026
Viaarxiv icon

EgoGenesis: Egocentric World-Action Modeling with Online Anchored Projective Memory and Action-3D RoPE

Add code
Jul 30, 2026
Viaarxiv icon

Uncertainty-Aware Reward Modeling for Stable RLHF

Add code
Jun 18, 2026
Viaarxiv icon

MMSkills: Towards Multimodal Skills for General Visual Agents

Add code
May 14, 2026
Viaarxiv icon

AgentDisCo: Towards Disentanglement and Collaboration in Open-ended Deep Research Agents

Add code
May 12, 2026
Viaarxiv icon

Optimal Transport for LLM Reward Modeling from Noisy Preference

Add code
May 07, 2026
Viaarxiv icon

ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents

Add code
Apr 26, 2026
Viaarxiv icon

MuSEAgent: A Multimodal Reasoning Agent with Stateful Experiences

Add code
Mar 29, 2026
Viaarxiv icon

GlyphBanana: Advancing Precise Text Rendering Through Agentic Workflows

Add code
Mar 12, 2026
Viaarxiv icon