Picture for Hongcheng Gao

Hongcheng Gao

StreamOPD: A Post-Training Recipe with Spatio-Temporal Cue Gating for Streaming Video Understanding

Add code
Aug 17, 2026
Viaarxiv icon

PerceptionBench: Evaluating Atomic Visual Perception in Multimodal Large Language Models

Add code
Jul 27, 2026
Viaarxiv icon

Kimi K3: Open Frontier Intelligence

Add code
Jul 27, 2026
Viaarxiv icon

AgentOmnia: Scaling Agentic Models for Full-Scenario Applications

Add code
Jul 25, 2026
Viaarxiv icon

OmniaBench: Benchmarking General AI Agents Across Diverse Scenarios

Add code
Jul 16, 2026
Viaarxiv icon

Evidence-Grounded AI for Musculoskeletal Care

Add code
Jul 14, 2026
Viaarxiv icon

SpatialWorld: Benchmarking Interactive Spatial Reasoning of Multimodal Agents in Real-World Tasks

Add code
Jun 08, 2026
Viaarxiv icon

OpenWorldLib: A Unified Codebase and Definition of Advanced World Models

Add code
Apr 06, 2026
Viaarxiv icon

MedScope: Incentivizing "Think with Videos" for Clinical Reasoning via Coarse-to-Fine Tool Calling

Add code
Feb 11, 2026
Viaarxiv icon

Kimi K2.5: Visual Agentic Intelligence

Add code
Feb 02, 2026
Viaarxiv icon