Picture for Michael Qizhe Shieh

Michael Qizhe Shieh

RSIBench-Data: Benchmarking Data-Centric Research for Recursive Self-Improvement

Add code
Jul 28, 2026
Viaarxiv icon

Scaling GUI Agents with Visual State Transitions

Add code
Jul 27, 2026
Viaarxiv icon

Vortex: Efficient and Programmable Sparse Attention Serving for AI Agents

Add code
Jun 04, 2026
Viaarxiv icon

ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents

Add code
Apr 26, 2026
Viaarxiv icon

Chasing the Public Score: User Pressure and Evaluation Exploitation in Coding Agent Workflows

Add code
Apr 22, 2026
Viaarxiv icon

Your Agent, Their Asset: A Real-World Safety Analysis of OpenClaw

Add code
Apr 06, 2026
Viaarxiv icon

Gym-V: A Unified Vision Environment System for Agentic Vision Research

Add code
Mar 17, 2026
Viaarxiv icon

ImageEdit-R1: Boosting Multi-Agent Image Editing via Reinforcement Learning

Add code
Mar 09, 2026
Viaarxiv icon

In-Context Reinforcement Learning for Tool Use in Large Language Models

Add code
Mar 09, 2026
Viaarxiv icon

LongRLVR: Long-Context Reinforcement Learning Requires Verifiable Context Rewards

Add code
Mar 02, 2026
Viaarxiv icon