Picture for Wenxuan Huang

Wenxuan Huang

Video-DeepResearch: Towards the Next-Generation Multimodal Deepresearch Agent

Add code
Aug 04, 2026
Viaarxiv icon

JarvisHub: An Open Harness for Canvas-Native Multimodal Creative Agents

Add code
Jul 26, 2026
Viaarxiv icon

From Player to Master: Enhancing Test-Time Learning of LLM Agents via Reinforcement Learning over Memory

Add code
Jun 07, 2026
Viaarxiv icon

OpenSearch-VL: An Open Recipe for Frontier Multimodal Search Agents

Add code
May 06, 2026
Viaarxiv icon

AblateCell: A Reproduce-then-Ablate Agent for Virtual Cell Repositories

Add code
Apr 21, 2026
Viaarxiv icon

Unify-Agent: A Unified Multimodal Agent for World-Grounded Image Synthesis

Add code
Apr 01, 2026
Viaarxiv icon

SCALE:Scalable Conditional Atlas-Level Endpoint transport for virtual cell perturbation prediction

Add code
Mar 19, 2026
Viaarxiv icon

HarmonyCell: Automating Single-Cell Perturbation Modeling under Semantic and Distribution Shifts

Add code
Mar 02, 2026
Viaarxiv icon

GroupGPT: A Token-efficient and Privacy-preserving Agentic Framework for Multi-User Chat Assistant

Add code
Mar 01, 2026
Viaarxiv icon

VimRAG: Navigating Massive Visual Context in Retrieval-Augmented Generation via Multimodal Memory Graph

Add code
Feb 13, 2026
Viaarxiv icon