Picture for Can Lv

Can Lv

TRCA: Transition-wise Rubric Credit Assignment for Long-horizon LLM Agents

Add code
Aug 17, 2026
Viaarxiv icon

Mitigating False Credit Propagation: Probabilistic Graphical Reward Aggregation for Rubric-Based Reinforcement Learning

Add code
Jun 02, 2026
Viaarxiv icon

HarnessForge: Joint Harness and Policy Evolution for Adaptive Agent Systems

Add code
Jun 01, 2026
Viaarxiv icon

All-Mem: Agentic Lifelong Memory via Dynamic Topology Evolution

Add code
Mar 20, 2026
Viaarxiv icon