Picture for Zhenhailong Wang

Zhenhailong Wang

Apodex Discovery: Reality Benchmarks and Environments for Evaluating and Building Discoverative Artificial Intelligence

Add code
Aug 11, 2026
Viaarxiv icon

CURV: Enhancing Chart Understanding Through Curriculum Visual Grounded Reasoning

Add code
Aug 03, 2026
Viaarxiv icon

Long-Horizon Embodied Decision-Making via Multimodal Memory Compression

Add code
Aug 02, 2026
Viaarxiv icon

Trimming the Long-Tail of Visual World Modeling Evaluation

Add code
Jun 23, 2026
Viaarxiv icon

PlanBench-XL: Evaluating Long-Horizon Planning of LLM Tool-Use Agents in Large-Scale Tool Ecosystems

Add code
Jun 21, 2026
Viaarxiv icon

ACCORD: Action-Conditioned Contextual Grounding for Language Agents

Add code
Jun 15, 2026
Viaarxiv icon

AdaPlanBench: Evaluating Adaptive Planning in Large Language Model Agents under World and User Constraints

Add code
Jun 04, 2026
Viaarxiv icon

Brick-Composer: Using MLLMs for Assembly with Diverse Bricks

Add code
Jun 03, 2026
Viaarxiv icon

Crafter: A Multi-Agent Harness for Editable Scientific Figure Generation from Diverse Inputs

Add code
May 28, 2026
Viaarxiv icon

Advancing Creative Physical Intelligence in Large Multimodal Models

Add code
May 25, 2026
Viaarxiv icon