Picture for Yiwen Guo

Yiwen Guo

Progressive Agent Skill Generation via Reinforcement Learning

Add code
Aug 03, 2026
Viaarxiv icon

EvolvingWorld: An Open-Schema Framework for Co-Evolving Role-Play Agents and World Model in Interactive Literary World

Add code
Jul 19, 2026
Viaarxiv icon

MemDefrag: Latent Memory Defragmentation for Large Language Models

Add code
Jul 07, 2026
Viaarxiv icon

Many Voices, One Reward: Multi-Role Rubric Generation for LLM Judging and Reward Modeling

Add code
Jul 02, 2026
Viaarxiv icon

One-Step Token-to-Waveform Generation with MeanFlow in Latent Space

Add code
Jun 16, 2026
Viaarxiv icon

Representation-Aware Advantage Estimation: Your Reward Model Provides More Than A Scalar Output

Add code
Jun 09, 2026
Viaarxiv icon

World Models Meet Language Models: On the Complementarity of Concrete and Abstract Reasoning

Add code
Jun 02, 2026
Viaarxiv icon

UniSRM: A Unified Speech Reward Model for Reasoning-Based Fine-grained Assessment

Add code
May 22, 2026
Viaarxiv icon

DualOptim+: Bridging Shared and Decoupled Optimizer States for Better Machine Unlearning in Large Language Models

Add code
May 20, 2026
Viaarxiv icon

Time is Not a Label: Continuous Phase Rotation for Temporal Knowledge Graphs and Agentic Memory

Add code
Apr 13, 2026
Viaarxiv icon