Picture for Bingyu Zhu

Bingyu Zhu

Yuvion LLM: An Adversarially-Aware Large Language Model for Content And AI Safety

Add code
Jun 26, 2026
Viaarxiv icon

Yuvion VL: A Multimodal Foundation Model for Adversarial Content and AI Safety

Add code
Jun 23, 2026
Viaarxiv icon

From Context-Aware to Conflict-Aware: Generalizing Contrastive Decoding for Knowledge Conflict in LLMs

Add code
Jun 09, 2026
Viaarxiv icon

ConsisGuard: Aligning Safety Deliberation with Policy Enforcement in LLM Guardrails

Add code
May 29, 2026
Viaarxiv icon

Make LLM Learn to Synthesize from Streaming Experiences through Feedback

Add code
May 28, 2026
Viaarxiv icon

Robust and Generalizable Safety Steering for Text-to-Image Diffusion Transformers

Add code
May 28, 2026
Viaarxiv icon

Counterfactual Adversarial Learning with Representation Interpolation

Add code
Sep 10, 2021
Figure 1 for Counterfactual Adversarial Learning with Representation Interpolation
Figure 2 for Counterfactual Adversarial Learning with Representation Interpolation
Figure 3 for Counterfactual Adversarial Learning with Representation Interpolation
Figure 4 for Counterfactual Adversarial Learning with Representation Interpolation
Viaarxiv icon