Picture for Cheng Hong

Cheng Hong

ARENA: Automated Red-Teaming for Large Audio Language Models

Add code
Aug 16, 2026
Viaarxiv icon

DeepInvert: Semi-Supervised Embedding Inversion Against Obfuscated Language Models

Add code
Aug 05, 2026
Viaarxiv icon

Leak-Resistant Unlearning: A New Benchmark for Evaluating Multi-Hop Reasoning Consistency and Recovery Robustness

Add code
Aug 05, 2026
Viaarxiv icon

When New Generators Arrive: Lifelong Machine-Generated Text Attribution via Ridge Feature Transfer

Add code
Jun 04, 2026
Viaarxiv icon

Robustness of Vision Foundation Models to Common Perturbations

Add code
Apr 16, 2026
Viaarxiv icon

VLMShield: Efficient and Robust Defense of Vision-Language Models against Malicious Prompts

Add code
Apr 07, 2026
Viaarxiv icon

Hidden Ads: Behavior Triggered Semantic Backdoors for Advertisement Injection in Vision Language Models

Add code
Mar 29, 2026
Viaarxiv icon

FIT: Defying Catastrophic Forgetting in Continual LLM Unlearning

Add code
Jan 29, 2026
Viaarxiv icon

EnchTable: Unified Safety Alignment Transfer in Fine-tuned Large Language Models

Add code
Nov 13, 2025
Viaarxiv icon

GaussMarker: Robust Dual-Domain Watermark for Diffusion Models

Add code
Jun 13, 2025
Viaarxiv icon