Picture for Tian Lan

Tian Lan

Search2Skill: Skill Distillation Beyond Knowledge Boundaries Via Rubric-Based Reinforcement Learning

Add code
Aug 05, 2026
Viaarxiv icon

Learning Not to Optimize: Physics-Informed Action-Space Reshaping for Intent-Based Network Control

Add code
Aug 02, 2026
Viaarxiv icon

A Heuristic Perspective on Debiasing Language Models

Add code
Aug 01, 2026
Viaarxiv icon

Minimal Markovization via Stable Quotients in Holonomy-Cover Decision Processes

Add code
Jul 29, 2026
Viaarxiv icon

The Topology of Ill-Posed Questions: Persistent Homology for Detection and Steering in LLMs

Add code
Jun 22, 2026
Viaarxiv icon

Localizing Credit at the Divergence: Path-Conditioned Self-Distillation for LLM Reasoning

Add code
Jun 14, 2026
Viaarxiv icon

MomentKV: Closing the Directional Gap in KV Cache Eviction for Long-Context Inference

Add code
Jun 01, 2026
Viaarxiv icon

MTAVG-Bench 2.0: Diagnosing Failure Modes of Cinematic Expressiveness in Multi-Talker Audio-Video Generation

Add code
May 27, 2026
Viaarxiv icon

FedQHD: Closed-Form Function-Space Federated Reinforcement Learning

Add code
May 27, 2026
Viaarxiv icon

OPPO: Bayesian Value Recursion for Token-Level Credit Assignment in LLM Reasoning

Add code
May 21, 2026
Viaarxiv icon