Picture for Wenxuan Zhang

Wenxuan Zhang

Hybrid Advantage Estimation with Unified Critic for VLM Agentic Reinforcement Learning

Add code
Jul 26, 2026
Viaarxiv icon

Self-Evolving World Models for LLM Agent Planning

Add code
Jun 29, 2026
Viaarxiv icon

GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models

Add code
Jun 06, 2026
Viaarxiv icon

Beyond Alignment: Value Diversity as a Collective Property in Multicultural Agent Systems

Add code
Jun 04, 2026
Viaarxiv icon

Multilingual Fine-Tuning via Localized Gradient Conflict Resolution

Add code
Jun 04, 2026
Viaarxiv icon

Safety Paradox: How Enhanced Safety Awareness Leaves LLMs Vulnerable to Posterior Attack

Add code
Jun 04, 2026
Viaarxiv icon

What Should Agents Say? Action-state Communication for Efficient Multi-Agent Systems

Add code
Jun 03, 2026
Viaarxiv icon

Collaborative Space Object Detection with Multi-Satellite Viewpoints in LEO Constellations

Add code
Jun 01, 2026
Viaarxiv icon

Diagnosing Harmful Continuation in Answer-Correct Long-CoT Training Traces

Add code
May 28, 2026
Viaarxiv icon

Agentic World Modeling: Foundations, Capabilities, Laws, and Beyond

Add code
Apr 24, 2026
Viaarxiv icon