Picture for Haichang Gao

Haichang Gao

A Model Merging Approach for Continual MLLM Unlearning

Add code
Aug 05, 2026
Viaarxiv icon

Salami Attack: Stealthy Collusive Memory Poisoning against OpenClaw

Add code
Aug 03, 2026
Viaarxiv icon

Attention-Guided Reward for Reinforcement Learning-based Jailbreak against Large Reasoning Models

Add code
May 19, 2026
Viaarxiv icon

Guaranteed Jailbreaking Defense via Disrupt-and-Rectify Smoothing

Add code
May 11, 2026
Viaarxiv icon

Re-Triggering Safeguards within LLMs for Jailbreak Detection

Add code
May 11, 2026
Viaarxiv icon

ICU-Bench:Benchmarking Continual Unlearning in Multimodal Large Language Models

Add code
May 07, 2026
Viaarxiv icon

Null Space Constrained Contrastive Visual Forgetting for MLLM Unlearning

Add code
May 07, 2026
Viaarxiv icon

A Systematic Security Evaluation of OpenClaw and Its Variants

Add code
Apr 03, 2026
Viaarxiv icon

From Assistant to Double Agent: Formalizing and Benchmarking Attacks on OpenClaw for Personalized Local AI Agent

Add code
Feb 09, 2026
Viaarxiv icon

MLLM Machine Unlearning via Visual Knowledge Distillation

Add code
Dec 12, 2025
Viaarxiv icon