Picture for Zhiyu Pan

Zhiyu Pan

AVSCap: Orchestrating Audio-Visual Synergy for Omni-modal Video Captioning

Add code
Jul 14, 2026
Viaarxiv icon

Compression and Retrieval: Implicit Memory Retrieval for Video World Models

Add code
Jun 22, 2026
Viaarxiv icon

Identity-Consistent Multi-Pose Generation of Contactless Fingerprints

Add code
May 05, 2026
Viaarxiv icon

Through the Lens of Contrast: Self-Improving Visual Reasoning in VLMs

Add code
Mar 03, 2026
Viaarxiv icon

Semi-Supervised High Dynamic Range Image Reconstructing via Bi-Level Uncertain Area Masking

Add code
Nov 17, 2025
Viaarxiv icon

Fixed-Length Dense Fingerprint Representation

Add code
May 06, 2025
Viaarxiv icon

Finger Pose Estimation for Under-screen Fingerprint Sensor

Add code
May 05, 2025
Viaarxiv icon

Exploring Contextual Attribute Density in Referring Expression Counting

Add code
Mar 16, 2025
Figure 1 for Exploring Contextual Attribute Density in Referring Expression Counting
Figure 2 for Exploring Contextual Attribute Density in Referring Expression Counting
Figure 3 for Exploring Contextual Attribute Density in Referring Expression Counting
Figure 4 for Exploring Contextual Attribute Density in Referring Expression Counting
Viaarxiv icon

Exposure Completing for Temporally Consistent Neural High Dynamic Range Video Rendering

Add code
Jul 18, 2024
Viaarxiv icon

Camera-LiDAR Cross-modality Gait Recognition

Add code
Jul 03, 2024
Figure 1 for Camera-LiDAR Cross-modality Gait Recognition
Figure 2 for Camera-LiDAR Cross-modality Gait Recognition
Viaarxiv icon