Picture for Di Liang

Di Liang

Harmful Content Is Not Enough: Continuation Framing Moderates In-Context Emergent Misalignment

Add code
Aug 08, 2026
Viaarxiv icon

UXBench: Benchmarking User Experience in AI Assistants

Add code
Jun 09, 2026
Viaarxiv icon

TRACE: Discovering Task-Specific Parameter via Adaptation-Aware Probing for Continual Fine-Tuning

Add code
May 29, 2026
Viaarxiv icon

Parameter Importance is Not Static: Evolving Parameter Isolation for Supervised Fine-Tuning

Add code
Apr 15, 2026
Viaarxiv icon

Learning from Contrasts: Synthesizing Reasoning Paths from Diverse Search Trajectories

Add code
Apr 13, 2026
Viaarxiv icon

Reason Only When Needed: Efficient Generative Reward Modeling via Model-Internal Uncertainty

Add code
Apr 11, 2026
Viaarxiv icon

Why Supervised Fine-Tuning Fails to Learn: A Systematic Study of Incomplete Learning in Large Language Models

Add code
Apr 11, 2026
Viaarxiv icon

DPI: Exploiting Parameter Heterogeneity for Interference-Free Fine-Tuning

Add code
Jan 25, 2026
Viaarxiv icon

Who Stole Your Data? A Method for Detecting Unauthorized RAG Theft

Add code
Oct 09, 2025
Viaarxiv icon

R-Capsule: Compressing High-Level Plans for Efficient Large Language Model Reasoning

Add code
Sep 26, 2025
Viaarxiv icon