Picture for Xuanjing Huang

Xuanjing Huang

IACM-RL: Intent-Aware Context Management and Reinforcement Learning for Complex Tool Invocation under Dynamic Intent Fluctuations

Add code
Aug 03, 2026
Viaarxiv icon

AgentHPOBench: A Benchmark For Evaluating LLM Agents as Sequential Hyperparameter Optimizers

Add code
Jul 31, 2026
Viaarxiv icon

AgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments

Add code
Jul 06, 2026
Viaarxiv icon

Uncovering Salience-Driven Dynamics in Consumer Confidence with Generative Social Simulation

Add code
Jun 29, 2026
Viaarxiv icon

Mitigating Position Bias in Transformers via Layer-Specific Positional Embedding Scaling

Add code
Jun 26, 2026
Viaarxiv icon

LegalWorld: A Life-Cycle Interactive Environment for Legal Agents

Add code
Jun 17, 2026
Viaarxiv icon

LIBERO-Occ: Evaluating and Improving Vision-Language-Action Models under Scene-Induced Occlusion via Viewpoint Imagination

Add code
Jun 09, 2026
Viaarxiv icon

Two Bridges, One Pathway: From VLMs to Generalizable VLAs with Embodied Trajectory-Coupled Data

Add code
Jun 07, 2026
Viaarxiv icon

Entropy Is Not Enough: Unlocking Effective Reinforcement Learning for Visual Reasoning via Vision-Anchored Token Selection

Add code
Jun 03, 2026
Viaarxiv icon

EntangleCodec: A Unified Discrete Audio Tokenizer via Semantic-Acoustic Entanglement

Add code
Jun 01, 2026
Viaarxiv icon