Picture for Zhijing Jin

Zhijing Jin

How Does Alignment Tuning Shape Representations of Sycophancy and Related Cue-Induced Biases in LLMs?

Add code
Jul 20, 2026
Viaarxiv icon

When Agents Lie: Premeditation, Persistence, and Exploitation in Repeated Games

Add code
Jul 06, 2026
Viaarxiv icon

PruneGround: Plug-and-play Spatial Pruning for 3D Visual Grounding

Add code
Jun 30, 2026
Viaarxiv icon

Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR

Add code
Jun 23, 2026
Viaarxiv icon

Evaluating Second-Order Bias of LLMs Through Epistemic Entitlement

Add code
Jun 16, 2026
Viaarxiv icon

PaperMentor: A Human-Centered Multi-Agent Writing Tutor for AI Research Papers on Overleaf

Add code
Jun 07, 2026
Viaarxiv icon

STRIDE: Training Data Attribution via Sparse Recovery from Subset Perturbations

Add code
Jun 03, 2026
Viaarxiv icon

Decomposing and Measuring Evaluation Awareness

Add code
May 21, 2026
Viaarxiv icon

Trustworthy AI Suffers from Invariance Conflicts and Causality is The Solution

Add code
May 04, 2026
Viaarxiv icon

CoopEval: Benchmarking Cooperation-Sustaining Mechanisms and LLM Agents in Social Dilemmas

Add code
Apr 16, 2026
Viaarxiv icon