Picture for Se-Young Yun

Se-Young Yun

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning

Add code
Aug 03, 2026
Viaarxiv icon

LLM-as-a-Tutor: Policy-Aware Prompt Adaptation for Non-Verifiable RL

Add code
Jul 05, 2026
Viaarxiv icon

CascadeFormer: Depth-Tapered Transformers Motivated by Gradient Fan-in Asymmetry

Add code
Jun 25, 2026
Viaarxiv icon

SpotAttention: Plug-In Block-Sparse Routing for Pretrained Long-Context Transformers

Add code
Jun 22, 2026
Viaarxiv icon

Process-Verified Reinforcement Learning for Theorem Proving via Lean

Add code
Jun 18, 2026
Viaarxiv icon

Bastion: Budget-Aware Speculative Decoding with Tree-structured Block Diffusion Drafting

Add code
May 28, 2026
Viaarxiv icon

Instance-Optimal Estimation with Multiple LLM Judges on a Budget

Add code
May 22, 2026
Viaarxiv icon

PerMix-RLVR: Preserving Persona Expressivity under Verifiable-Reward Alignment

Add code
Apr 10, 2026
Viaarxiv icon

Multi-Drafter Speculative Decoding with Alignment Feedback

Add code
Apr 07, 2026
Viaarxiv icon

mSFT: Addressing Dataset Mixtures Overfitting Heterogeneously in Multi-task SFT

Add code
Mar 25, 2026
Viaarxiv icon