Picture for Zifeng Cheng

Zifeng Cheng

Step-Level On-Policy Distillation: Interpolating Between On-Policy Distillation and Supervised Fine-Tuning

Add code
Aug 17, 2026
Viaarxiv icon

Dynamic Distribution-Aware Uncertainty Tracking in Vision-Language Representation Learning

Add code
Aug 10, 2026
Viaarxiv icon

Moving the Safety Barrier: Dynamic Routing Adaptive Alignment Against White-Box Attacks

Add code
Aug 02, 2026
Viaarxiv icon

ScaleErasure: Inference-Time Minimal Intervention for Precise Concept Erasure in Next-Scale Autoregressive Image Generation

Add code
Jun 28, 2026
Viaarxiv icon

Multi-Label Test-Time Adaptation with Bayesian Conditional Priors

Add code
Jun 11, 2026
Viaarxiv icon

Who Transfers Safety? Identifying and Targeting Cross-Lingual Shared Safety Neurons

Add code
Feb 01, 2026
Viaarxiv icon

TraceRouter: Robust Safety for Large Foundation Models via Path-Level Intervention

Add code
Jan 29, 2026
Viaarxiv icon

RegionMarker: A Region-Triggered Semantic Watermarking Framework for Embedding-as-a-Service Copyright Protection

Add code
Nov 17, 2025
Figure 1 for RegionMarker: A Region-Triggered Semantic Watermarking Framework for Embedding-as-a-Service Copyright Protection
Figure 2 for RegionMarker: A Region-Triggered Semantic Watermarking Framework for Embedding-as-a-Service Copyright Protection
Figure 3 for RegionMarker: A Region-Triggered Semantic Watermarking Framework for Embedding-as-a-Service Copyright Protection
Figure 4 for RegionMarker: A Region-Triggered Semantic Watermarking Framework for Embedding-as-a-Service Copyright Protection
Viaarxiv icon

Steering When Necessary: Flexible Steering Large Language Models with Backtracking

Add code
Aug 25, 2025
Viaarxiv icon

Contrastive Prompting Enhances Sentence Embeddings in LLMs through Inference-Time Steering

Add code
May 19, 2025
Viaarxiv icon