Picture for Zijun Li

Zijun Li

TextRefine: Improving Textual Fidelity, Spatial Placement, and Glyph Rendering for Text Editing in Product Posters

Add code
Aug 20, 2026
Viaarxiv icon

Multimodal Plant Root Phenotyping with Integration of 3D Skeleton Extraction and Language Analysis

Add code
Aug 04, 2026
Viaarxiv icon

DetailAnywhere: Fashion Detail Generation via Cross-Modal Feature Alignment Distillation

Add code
Jul 02, 2026
Viaarxiv icon

CaC: Advancing Video Reward Models via Hierarchical Spatiotemporal Concentrating

Add code
May 12, 2026
Viaarxiv icon

MedVAR: Towards Scalable and Efficient Medical Image Generation via Next-scale Autoregressive Prediction

Add code
Feb 16, 2026
Viaarxiv icon

DV-VLN: Dual Verification for Reliable LLM-Based Vision-and-Language Navigation

Add code
Jan 26, 2026
Viaarxiv icon

Automated Genomic Interpretation via Concept Bottleneck Models for Medical Robotics

Add code
Oct 02, 2025
Viaarxiv icon

Adaptive Event Stream Slicing for Open-Vocabulary Event-Based Object Detection via Vision-Language Knowledge Distillation

Add code
Oct 01, 2025
Viaarxiv icon

Sculpting Features from Noise: Reward-Guided Hierarchical Diffusion for Task-Optimal Feature Transformation

Add code
May 21, 2025
Figure 1 for Sculpting Features from Noise: Reward-Guided Hierarchical Diffusion for Task-Optimal Feature Transformation
Figure 2 for Sculpting Features from Noise: Reward-Guided Hierarchical Diffusion for Task-Optimal Feature Transformation
Figure 3 for Sculpting Features from Noise: Reward-Guided Hierarchical Diffusion for Task-Optimal Feature Transformation
Figure 4 for Sculpting Features from Noise: Reward-Guided Hierarchical Diffusion for Task-Optimal Feature Transformation
Viaarxiv icon

TMCIR: Token Merge Benefits Composed Image Retrieval

Add code
Apr 15, 2025
Viaarxiv icon