Picture for Peiyang Liu

Peiyang Liu

Harmful Content Is Not Enough: Continuation Framing Moderates In-Context Emergent Misalignment

Add code
Aug 08, 2026
Viaarxiv icon

AdaMTP: An Adaptive Training Paradigm for Multi-Token Prediction

Add code
Aug 01, 2026
Viaarxiv icon

Progress- and Reliability-Oriented Group Policy Optimization for Agentic Reinforcement Learning

Add code
Jul 05, 2026
Viaarxiv icon

Looking Farther with Confidence: Uncertainty-Guided Future Learning for Sequential Recommendation

Add code
May 27, 2026
Viaarxiv icon

Parameter Importance is Not Static: Evolving Parameter Isolation for Supervised Fine-Tuning

Add code
Apr 15, 2026
Viaarxiv icon

Learning from Contrasts: Synthesizing Reasoning Paths from Diverse Search Trajectories

Add code
Apr 13, 2026
Viaarxiv icon

Why Supervised Fine-Tuning Fails to Learn: A Systematic Study of Incomplete Learning in Large Language Models

Add code
Apr 11, 2026
Viaarxiv icon

Reason Only When Needed: Efficient Generative Reward Modeling via Model-Internal Uncertainty

Add code
Apr 11, 2026
Viaarxiv icon

StructKV: Preserving the Structural Skeleton for Scalable Long-Context Inference

Add code
Apr 08, 2026
Viaarxiv icon

SQL-ASTRA: Alleviating Sparse Feedback in Agentic SQL via Column-Set Matching and Trajectory Aggregation

Add code
Mar 17, 2026
Viaarxiv icon