Picture for Lingpeng Kong

Lingpeng Kong

Structuring Semantic Embeddings for Principle Evaluation: A Prototype-Guided Contrastive Learning Approach

Add code
Aug 15, 2026
Viaarxiv icon

OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models

Add code
Jul 30, 2026
Viaarxiv icon

SoftSkill: Behavioral Compression for Contextual Adaptation

Add code
Jun 18, 2026
Viaarxiv icon

DreamReasoner-8B: Block-Size Curriculum Learning for Diffusion Reasoning Models

Add code
Jun 17, 2026
Viaarxiv icon

Self-Distilled Trajectory-Aware Boltzmann Modeling: Bridging the Training-Inference Discrepancy in Diffusion Language Models

Add code
May 12, 2026
Viaarxiv icon

The Granularity Axis: A Micro-to-Macro Latent Direction for Social Roles in Language Models

Add code
May 07, 2026
Viaarxiv icon

SAVOIR: Learning Social Savoir-Faire via Shapley-based Reward Attribution

Add code
Apr 21, 2026
Viaarxiv icon

Stratagem: Learning Transferable Reasoning via Trajectory-Modulated Game Self-Play

Add code
Apr 20, 2026
Viaarxiv icon

ImplicitMemBench: Measuring Unconscious Behavioral Adaptation in Large Language Models

Add code
Apr 09, 2026
Viaarxiv icon

Claw-Eval: Toward Trustworthy Evaluation of Autonomous Agents

Add code
Apr 07, 2026
Viaarxiv icon