Picture for Stefano Soatto

Stefano Soatto

UCLA-CS

StaminaBench: Stress-Testing Coding Agents over 100 Interaction Turns

Add code
Jun 17, 2026
Viaarxiv icon

DLLG: Dynamic Logit-Level Gating of LLM Experts

Add code
Jun 03, 2026
Viaarxiv icon

ExecTune: Effective Steering of Black-Box LLMs with Guide Models

Add code
Apr 09, 2026
Viaarxiv icon

Asymmetric Actor-Critic for Multi-turn LLM Agents

Add code
Mar 31, 2026
Viaarxiv icon

Learning When to Attend: Conditional Memory Access for Long-Context LLMs

Add code
Mar 18, 2026
Viaarxiv icon

Reinforcement-aware Knowledge Distillation for LLM Reasoning

Add code
Feb 26, 2026
Viaarxiv icon

Evolutionary Generation of Multi-Agent Systems

Add code
Feb 06, 2026
Viaarxiv icon

Talk2Move: Reinforcement Learning for Text-Instructed Object-Level Geometric Transformation in Scenes

Add code
Jan 08, 2026
Viaarxiv icon

Experience-Guided Adaptation of Inference-Time Reasoning Strategies

Add code
Nov 14, 2025
Figure 1 for Experience-Guided Adaptation of Inference-Time Reasoning Strategies
Figure 2 for Experience-Guided Adaptation of Inference-Time Reasoning Strategies
Figure 3 for Experience-Guided Adaptation of Inference-Time Reasoning Strategies
Figure 4 for Experience-Guided Adaptation of Inference-Time Reasoning Strategies
Viaarxiv icon

MURPHY: Multi-Turn GRPO for Self Correcting Code Generation

Add code
Nov 11, 2025
Viaarxiv icon