Picture for Zhuoran Zhang

Zhuoran Zhang

FocusMem: Factorizing Content, Readout, and Trust in Latent GUI Memory

Add code
Aug 05, 2026
Viaarxiv icon

OmniPack: Unified Token Compression for Efficient Omni-modal Large Language Models

Add code
Aug 04, 2026
Viaarxiv icon

Beacon: Knowing When and How to Perform Agentic Visual Reasoning

Add code
Jul 30, 2026
Viaarxiv icon

RefCaptioner: Multi-Reference Image-Grounded Video Captioning

Add code
Jul 30, 2026
Viaarxiv icon

KeyFrame-Compass: Towards Comprehensive Evaluation of Keyframe-Conditioned Video Generation

Add code
Jul 15, 2026
Viaarxiv icon

LongAV-Compass: Towards Unified Evaluation of Minute-Scale Audio-Visual Generation Across T2AV, I2AV, and V2AV

Add code
May 25, 2026
Viaarxiv icon

Artifact-Bench: Evaluating MLLMs on Detecting and Assessing the Artifacts of AI-Generated Videos

Add code
May 18, 2026
Viaarxiv icon

Hybrid Attribution Priors for Explainable and Robust Model Training

Add code
Dec 09, 2025
Viaarxiv icon

MME-VideoOCR: Evaluating OCR-Based Capabilities of Multimodal LLMs in Video Scenarios

Add code
May 27, 2025
Viaarxiv icon

EAP-GP: Mitigating Saturation Effect in Gradient-based Automated Circuit Identification

Add code
Feb 07, 2025
Figure 1 for EAP-GP: Mitigating Saturation Effect in Gradient-based Automated Circuit Identification
Figure 2 for EAP-GP: Mitigating Saturation Effect in Gradient-based Automated Circuit Identification
Figure 3 for EAP-GP: Mitigating Saturation Effect in Gradient-based Automated Circuit Identification
Figure 4 for EAP-GP: Mitigating Saturation Effect in Gradient-based Automated Circuit Identification
Viaarxiv icon