Picture for Sikuan Yan

Sikuan Yan

Mendel Gödel Machine: Recursive Self-Improving Coding Agents via Comparative Evolution

Add code
Aug 07, 2026
Viaarxiv icon

MemWM: Memory-Augmented Text-Based World Model

Add code
Aug 07, 2026
Viaarxiv icon

MetaSkill-Evolve: Recursive Self-Improvement of LLM Agents via Two-Timescale Meta-Skill Evolution

Add code
Jul 06, 2026
Viaarxiv icon

EchoRL: Reinforcement Learning via Rollout Echoing

Add code
May 29, 2026
Viaarxiv icon

Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents

Add code
May 20, 2026
Viaarxiv icon

Routing-Free Mixture-of-Experts

Add code
Apr 01, 2026
Viaarxiv icon

Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning

Add code
Aug 27, 2025
Figure 1 for Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Figure 2 for Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Figure 3 for Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Figure 4 for Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Viaarxiv icon

TCP: a Benchmark for Temporal Constraint-Based Planning

Add code
May 26, 2025
Viaarxiv icon