Picture for Yuhui Wang

Yuhui Wang

IACM-RL: Intent-Aware Context Management and Reinforcement Learning for Complex Tool Invocation under Dynamic Intent Fluctuations

Add code
Aug 03, 2026
Viaarxiv icon

LaCache: Robust Semantic Caching for LLM Serving

Add code
Aug 03, 2026
Viaarxiv icon

Hybrid Advantage Estimation with Unified Critic for VLM Agentic Reinforcement Learning

Add code
Jul 26, 2026
Viaarxiv icon

LLMEval-Logic: A Solver-Verified Chinese Benchmark for Logical Reasoning of LLMs with Adversarial Hardening

Add code
May 19, 2026
Viaarxiv icon

MAGE: Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory

Add code
May 04, 2026
Viaarxiv icon

Planning to Explore: Curiosity-Driven Planning for LLM Test Generation

Add code
Apr 06, 2026
Viaarxiv icon

JFTA-Bench: Evaluate LLM's Ability of Tracking and Analyzing Malfunctions Using Fault Trees

Add code
Mar 24, 2026
Viaarxiv icon

Efficient Morphology-Control Co-Design via Stackelberg Proximal Policy Optimization

Add code
Mar 16, 2026
Viaarxiv icon

AgentLAB: Benchmarking LLM Agents against Long-Horizon Attacks

Add code
Feb 18, 2026
Viaarxiv icon

DFPO: Scaling Value Modeling via Distributional Flow towards Robust and Generalizable LLM Post-Training

Add code
Feb 05, 2026
Viaarxiv icon