Picture for Kangning Zhang

Kangning Zhang

Learning from Unreachable Rewards: Hint-Conditioned Reinforcement Learning for Generative Recommendation

Add code
Aug 15, 2026
Viaarxiv icon

HCGRec: Hint-Conditioned Generative Recommendation with Semantic IDs

Add code
Aug 12, 2026
Viaarxiv icon

Harness-R1: Learning to Edit Executable Runtime Harnesses from Agent Failure Trajectories

Add code
Aug 03, 2026
Viaarxiv icon

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation

Add code
Jul 30, 2026
Viaarxiv icon

SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution

Add code
Jul 29, 2026
Viaarxiv icon

DiffCold: A Diffusion-based Generative Model for Cold-Start Item Recommendation

Add code
Jun 10, 2026
Viaarxiv icon

MMSkills: Towards Multimodal Skills for General Visual Agents

Add code
May 14, 2026
Viaarxiv icon

MuSEAgent: A Multimodal Reasoning Agent with Stateful Experiences

Add code
Mar 29, 2026
Viaarxiv icon

LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls

Add code
Nov 18, 2025
Figure 1 for LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
Figure 2 for LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
Figure 3 for LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
Figure 4 for LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
Viaarxiv icon

Fints: Efficient Inference-Time Personalization for LLMs with Fine-Grained Instance-Tailored Steering

Add code
Oct 31, 2025
Viaarxiv icon