Picture for Dingwei Zhu

Dingwei Zhu

SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information

Add code
Aug 11, 2026
Viaarxiv icon

IACM-RL: Intent-Aware Context Management and Reinforcement Learning for Complex Tool Invocation under Dynamic Intent Fluctuations

Add code
Aug 03, 2026
Viaarxiv icon

AgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments

Add code
Jul 06, 2026
Viaarxiv icon

Entropy Polarity in Reinforcement Fine-Tuning: Direction, Asymmetry, and Control

Add code
May 14, 2026
Viaarxiv icon

EVPO: Explained Variance Policy Optimization for Adaptive Critic Utilization in LLM Post-Training

Add code
Apr 21, 2026
Viaarxiv icon

JFTA-Bench: Evaluate LLM's Ability of Tracking and Analyzing Malfunctions Using Fault Trees

Add code
Mar 24, 2026
Viaarxiv icon

MagicAgent: Towards Generalized Agent Planning

Add code
Feb 22, 2026
Viaarxiv icon

DFPO: Scaling Value Modeling via Distributional Flow towards Robust and Generalizable LLM Post-Training

Add code
Feb 05, 2026
Viaarxiv icon