Picture for Wensheng Zhang

Wensheng Zhang

Synergistic Dual-Branch Adaptation for Multi-modal Generalized Category Discovery

Add code
Jun 19, 2026
Viaarxiv icon

Wan-R1: Verifiable-Reinforcement Learning for Video Reasoning

Add code
Mar 29, 2026
Viaarxiv icon

GradMAP: Faster Layer Pruning with Gradient Metric and Projection Compensation

Add code
Feb 16, 2026
Viaarxiv icon

FedProtoKD: Dual Knowledge Distillation with Adaptive Class-wise Prototype Margin for Heterogeneous Federated Learning

Add code
Aug 27, 2025
Viaarxiv icon

Reasoning Multimodal Large Language Model: Data Contamination and Dynamic Evaluation

Add code
Jun 08, 2025
Figure 1 for Reasoning Multimodal Large Language Model: Data Contamination and Dynamic Evaluation
Figure 2 for Reasoning Multimodal Large Language Model: Data Contamination and Dynamic Evaluation
Figure 3 for Reasoning Multimodal Large Language Model: Data Contamination and Dynamic Evaluation
Figure 4 for Reasoning Multimodal Large Language Model: Data Contamination and Dynamic Evaluation
Viaarxiv icon

Natural Reflection Backdoor Attack on Vision Language Model for Autonomous Driving

Add code
May 09, 2025
Viaarxiv icon

Is your multimodal large language model a good science tutor?

Add code
May 09, 2025
Viaarxiv icon

Is Your Video Language Model a Reliable Judge?

Add code
Mar 07, 2025
Viaarxiv icon

On Fairness of Unified Multimodal Large Language Model for Image Generation

Add code
Feb 05, 2025
Figure 1 for On Fairness of Unified Multimodal Large Language Model for Image Generation
Figure 2 for On Fairness of Unified Multimodal Large Language Model for Image Generation
Figure 3 for On Fairness of Unified Multimodal Large Language Model for Image Generation
Figure 4 for On Fairness of Unified Multimodal Large Language Model for Image Generation
Viaarxiv icon

AdaptGCD: Multi-Expert Adapter Tuning for Generalized Category Discovery

Add code
Oct 29, 2024
Viaarxiv icon