Picture for Ruhan Wang

Ruhan Wang

Recursive Synthesis for Long-Horizon Terminal Tasks

Add code
Aug 07, 2026
Viaarxiv icon

Stale but Stable: Staleness-Adaptive Trust Regions for Stabilizing Asynchronous Reinforcement Learning

Add code
Jul 21, 2026
Viaarxiv icon

Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable

Add code
Jul 14, 2026
Viaarxiv icon

Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading

Add code
Jul 13, 2026
Viaarxiv icon

FERA: Uncertainty-Aware Federated Reasoning for Large Language Models

Add code
May 11, 2026
Viaarxiv icon

How to Provably Improve Return Conditioned Supervised Learning?

Add code
Jun 10, 2025
Figure 1 for How to Provably Improve Return Conditioned Supervised Learning?
Figure 2 for How to Provably Improve Return Conditioned Supervised Learning?
Figure 3 for How to Provably Improve Return Conditioned Supervised Learning?
Figure 4 for How to Provably Improve Return Conditioned Supervised Learning?
Viaarxiv icon

Federated In-Context Learning: Iterative Refinement for Improved Answer Quality

Add code
Jun 09, 2025
Viaarxiv icon

Towards Agentic Recommender Systems in the Era of Multimodal Large Language Models

Add code
Mar 20, 2025
Viaarxiv icon

Quantum Diffusion Models for Few-Shot Learning

Add code
Nov 06, 2024
Figure 1 for Quantum Diffusion Models for Few-Shot Learning
Figure 2 for Quantum Diffusion Models for Few-Shot Learning
Figure 3 for Quantum Diffusion Models for Few-Shot Learning
Figure 4 for Quantum Diffusion Models for Few-Shot Learning
Viaarxiv icon

Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning

Add code
Oct 30, 2024
Figure 1 for Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning
Figure 2 for Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning
Figure 3 for Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning
Figure 4 for Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning
Viaarxiv icon