Picture for Juanzi Li

Juanzi Li

DeepWeaver: Bridging the Evidence Synthesis Gap in Open-Ended Question Answering

Add code
Aug 19, 2026
Viaarxiv icon

SAEVerbalizer: Generating Explanations for Sparse Autoencoder Features via Representation Verbalization

Add code
Aug 13, 2026
Viaarxiv icon

SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators

Add code
Aug 07, 2026
Viaarxiv icon

TRAJDEBUG: Tracing Error Lifecycle to Identify Critical Failures in Long-Horizon Agent Trajectories

Add code
Aug 06, 2026
Viaarxiv icon

SFT Conflicts, RL Coexists: A Theoretical and Empirical Analysis of Multi-Task Learning for LLMs

Add code
Aug 06, 2026
Viaarxiv icon

Where Steering Signals Come From: Activation Source Selection in Activation Steering

Add code
Jul 28, 2026
Viaarxiv icon

Can LLM-as-a-Judge Reliably Verify Rubrics in Agentic Scenarios?

Add code
Jun 29, 2026
Viaarxiv icon

HG-Bench: A Benchmark for Multi-Page Handwritten Answer-Region Grounding in Automated Homework Assessment

Add code
Jun 24, 2026
Viaarxiv icon

An LMM for Precisely Grounding Elements in Documents

Add code
Jun 23, 2026
Viaarxiv icon

EnvRL: Learn from Environment Dynamics in Agentic Reinforcement Learning

Add code
Jun 16, 2026
Viaarxiv icon