Picture for Zhen Guo

Zhen Guo

Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology, Cambridge, Massachusetts, 02139, USA

SCOPE: Subspace Clustering with Online Per-Head Top-K Estimation for Sparse Video Attention

Add code
Aug 13, 2026
Viaarxiv icon

STEAM: Self-Supervised Temporal Ensemble Advantage Modeling for Real-World Robot Learning

Add code
Jun 29, 2026
Viaarxiv icon

WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL

Add code
Feb 15, 2026
Viaarxiv icon

RLinf-USER: A Unified and Extensible System for Real-World Online Policy Learning in Embodied AI

Add code
Feb 08, 2026
Viaarxiv icon

CL-bench: A Benchmark for Context Learning

Add code
Feb 03, 2026
Viaarxiv icon

MICo-150K: A Comprehensive Dataset Advancing Multi-Image Composition

Add code
Dec 08, 2025
Figure 1 for MICo-150K: A Comprehensive Dataset Advancing Multi-Image Composition
Figure 2 for MICo-150K: A Comprehensive Dataset Advancing Multi-Image Composition
Figure 3 for MICo-150K: A Comprehensive Dataset Advancing Multi-Image Composition
Figure 4 for MICo-150K: A Comprehensive Dataset Advancing Multi-Image Composition
Viaarxiv icon

$π_\texttt{RL}$: Online RL Fine-tuning for Flow-based Vision-Language-Action Models

Add code
Oct 29, 2025
Figure 1 for $π_\texttt{RL}$: Online RL Fine-tuning for Flow-based Vision-Language-Action Models
Figure 2 for $π_\texttt{RL}$: Online RL Fine-tuning for Flow-based Vision-Language-Action Models
Figure 3 for $π_\texttt{RL}$: Online RL Fine-tuning for Flow-based Vision-Language-Action Models
Figure 4 for $π_\texttt{RL}$: Online RL Fine-tuning for Flow-based Vision-Language-Action Models
Viaarxiv icon

RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation

Add code
Sep 19, 2025
Figure 1 for RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation
Figure 2 for RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation
Figure 3 for RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation
Figure 4 for RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation
Viaarxiv icon

Persistent Backdoor Attacks in Continual Learning

Add code
Sep 20, 2024
Figure 1 for Persistent Backdoor Attacks in Continual Learning
Figure 2 for Persistent Backdoor Attacks in Continual Learning
Figure 3 for Persistent Backdoor Attacks in Continual Learning
Figure 4 for Persistent Backdoor Attacks in Continual Learning
Viaarxiv icon

Scaling Law Hypothesis for Multimodal Model

Add code
Sep 10, 2024
Viaarxiv icon