Picture for Xiaogeng Liu

Xiaogeng Liu

Decomposition Attacks Across Unlinkable Identities: Limits of Stateful Defenses for LLM Services

Add code
Aug 18, 2026
Viaarxiv icon

When Claws Remember but Do Not Tell: Stealthy Memory Injection in Persistent Personal Agents

Add code
Jul 06, 2026
Viaarxiv icon

MaskForge: Structure-Aware Adaptive Attacks for Jailbreaking Diffusion Large Language Models

Add code
Jun 01, 2026
Viaarxiv icon

SafeGen-Bench: Benchmarking Safety in Image-Conditioned Text-to-Video Generation

Add code
May 31, 2026
Viaarxiv icon

When Are Teacher Tokens Reliable? Position-Weighted On-Policy Self-Distillation for Reasoning

Add code
May 20, 2026
Viaarxiv icon

DecodingTrust-Agent Platform (DTap): A Controllable and Interactive Red-Teaming Platform for AI Agents

Add code
May 06, 2026
Viaarxiv icon

Mind Your HEARTBEAT! Claw Background Execution Inherently Enables Silent Memory Pollution

Add code
Mar 25, 2026
Viaarxiv icon

ROM: Real-time Overthinking Mitigation via Streaming Detection and Intervention

Add code
Mar 23, 2026
Viaarxiv icon

ReasoningBomb: A Stealthy Denial-of-Service Attack by Inducing Pathologically Long Reasoning in Large Reasoning Models

Add code
Jan 29, 2026
Viaarxiv icon

MetaAgent: Automatically Constructing Multi-Agent Systems Based on Finite State Machines

Add code
Jul 30, 2025
Viaarxiv icon