Picture for Wei Yang Bryan Lim

Wei Yang Bryan Lim

Persuasive and Compliant Tendencies Predict Group Decision-Making in Humans and Language Models

Add code
Aug 08, 2026
Viaarxiv icon

Adversarial Attacks for Good: A Survey of Proactive Protection across the Visual Content Lifecycle

Add code
Aug 05, 2026
Viaarxiv icon

CoCurve: Cross-Module Co-Pruning Curvature for Training-Free Structured LLM Pruning

Add code
Jul 20, 2026
Viaarxiv icon

Conditional Co-Ablation: Recovering Self-Repair Backups in Transformer Circuits

Add code
Jul 02, 2026
Viaarxiv icon

XDomainBench: Diagnosing Reasoning Collapse in High-Dimensional Scientific Knowledge Composition

Add code
May 14, 2026
Viaarxiv icon

Certified Robustness under Heterogeneous Perturbations via Hybrid Randomized Smoothing

Add code
May 13, 2026
Viaarxiv icon

MPU: Towards Secure and Privacy-Preserving Knowledge Unlearning for Large Language Models

Add code
Feb 27, 2026
Viaarxiv icon

AdapTools: Adaptive Tool-based Indirect Prompt Injection Attacks on Agentic LLMs

Add code
Feb 24, 2026
Viaarxiv icon

ICON: Indirect Prompt Injection Defense for Agents based on Inference-Time Correction

Add code
Feb 24, 2026
Viaarxiv icon

M-Loss: Quantifying Model Merging Compatibility with Limited Unlabeled Data

Add code
Feb 09, 2026
Viaarxiv icon