Picture for Yuntao Du

Yuntao Du

Does Forgetting Transfer Across Modalities? A Real-World Benchmark for Cross-Modal Knowledge Unlearning Evaluation

Add code
Aug 04, 2026
Viaarxiv icon

KnowHal: A Knowledge-Driven Benchmark for Comprehensive Multimodal Hallucination Evaluation

Add code
Aug 04, 2026
Viaarxiv icon

AgenticVAU: Multi-Agent Explore-Verify Reasoning for Video Anomaly Understanding

Add code
Aug 04, 2026
Viaarxiv icon

AutoVerifier: An Agentic Automated Verification Framework Using Large Language Models

Add code
Apr 03, 2026
Viaarxiv icon

MMKU-Bench: A Multimodal Update Benchmark for Diverse Visual Knowledge

Add code
Mar 16, 2026
Viaarxiv icon

Membership Inference Attacks Against Fine-tuned Diffusion Language Models

Add code
Jan 27, 2026
Viaarxiv icon

M3MAD-Bench: Are Multi-Agent Debates Really Effective Across Domains and Modalities?

Add code
Jan 06, 2026
Viaarxiv icon

Window-based Membership Inference Attacks Against Fine-tuned Large Language Models

Add code
Jan 06, 2026
Viaarxiv icon

KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Augmentations and Constraints

Add code
Oct 22, 2025
Viaarxiv icon

GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging

Add code
Aug 26, 2025
Figure 1 for GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging
Figure 2 for GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging
Figure 3 for GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging
Figure 4 for GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging
Viaarxiv icon