Picture for Zhuchenyang Liu

Zhuchenyang Liu

DistilVDR: A Compact End-to-End Visual Document Retriever via Dual-Student Distillation

Add code
Aug 11, 2026
Viaarxiv icon

Evidence Attribution in Visual Document Understanding without Coordinates or Region Labels

Add code
Jul 27, 2026
Viaarxiv icon

Encoder-Free Human Motion Understanding via Structured Motion Descriptions

Add code
Apr 23, 2026
Viaarxiv icon

Benchmarking and Mechanistic Analysis of Vision-Language Models for Cross-Depiction Assembly Instruction Alignment

Add code
Apr 01, 2026
Viaarxiv icon

LingoMotion: An Interpretable and Unambiguous Symbolic Representation for Human Motion

Add code
Mar 13, 2026
Viaarxiv icon

NanoVDR: Distilling a 2B Vision-Language Retriever into a 70M Text-Only Encoder for Visual Document Retrieval

Add code
Mar 13, 2026
Viaarxiv icon

Fine-grained Motion Retrieval via Joint-Angle Motion Images and Token-Patch Late Interaction

Add code
Mar 10, 2026
Viaarxiv icon

Look in the Middle: Structural Anchor Pruning for Scalable Visual RAG Indexing

Add code
Jan 27, 2026
Viaarxiv icon