Picture for Weiwen Liu

Weiwen Liu

Harness-R1: Learning to Edit Executable Runtime Harnesses from Agent Failure Trajectories

Add code
Aug 03, 2026
Viaarxiv icon

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation

Add code
Jul 30, 2026
Viaarxiv icon

SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution

Add code
Jul 29, 2026
Viaarxiv icon

BALTO: Balanced Token-Level Policy Optimization for Hallucination Mitigation

Add code
Jun 14, 2026
Viaarxiv icon

Retrospective Progress-Aware Self-Refinement for LLM Agent Training

Add code
Jun 12, 2026
Viaarxiv icon

Communication Policy Evolution for Proactive LLM Agents

Add code
Jun 12, 2026
Viaarxiv icon

LatentSkill: From In-Context Textual Skills to In-Weight Latent Skills for LLM Agents

Add code
Jun 04, 2026
Viaarxiv icon

SkillPager: Query-Adaptive Intra-Skill Navigation via Semantic Node Retrieval

Add code
May 30, 2026
Viaarxiv icon

DynaTree: Dynamic Agentic Retrieval Tree for Time-Sensitive News Retrieval

Add code
May 29, 2026
Viaarxiv icon

Anticipate and Learn: Unleashing Idle-Time Compute in Proactive Agents

Add code
May 26, 2026
Viaarxiv icon