Picture for Zhihao Zhu

Zhihao Zhu

WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA

Add code
Aug 02, 2026
Viaarxiv icon

When Search Agents Should Ask: DiscoBench for Clarification-Aware Deep Search

Add code
Jul 01, 2026
Viaarxiv icon

Revealing Training Data Exposure in Vision Language Large Models via Parameter Gradients

Add code
Jun 23, 2026
Viaarxiv icon

DistractMIA: Black-Box Membership Inference on Vision-Language Models via Semantic Distraction

Add code
May 12, 2026
Viaarxiv icon

Perception Without Engagement: Dissecting the Causal Discovery Deficit in LMMs

Add code
May 10, 2026
Viaarxiv icon

Analyzing Reasoning Consistency in Large Multimodal Models under Cross-Modal Conflicts

Add code
Jan 07, 2026
Viaarxiv icon

AI Meets Brain: Memory Systems from Cognitive Neuroscience to Autonomous Agents

Add code
Dec 29, 2025
Viaarxiv icon

Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework

Add code
Jul 22, 2025
Viaarxiv icon

Salient Temporal Encoding for Dynamic Scene Graph Generation

Add code
Mar 15, 2025
Viaarxiv icon

TDDBench: A Benchmark for Training data detection

Add code
Nov 05, 2024
Figure 1 for TDDBench: A Benchmark for Training data detection
Figure 2 for TDDBench: A Benchmark for Training data detection
Figure 3 for TDDBench: A Benchmark for Training data detection
Figure 4 for TDDBench: A Benchmark for Training data detection
Viaarxiv icon