Picture for Jinjian Zhang

Jinjian Zhang

CARE: Confidence-Aware Reasoning for Reliable Medical VQA

Add code
Aug 11, 2026
Viaarxiv icon

CARL: Constraint-Aware Reinforcement Learning for Planning with LLMs

Add code
Jul 06, 2026
Viaarxiv icon

STAPO: Selective Trajectory-Aware Policy Optimization for LLM Agent Training

Add code
Jul 06, 2026
Viaarxiv icon