Picture for Yanan Li

Yanan Li

Structure-Detail Decoupled Autoregressive Generation for Fast and High-Fidelity Virtual Try-On

Add code
Jul 13, 2026
Viaarxiv icon

The Turning Point of 3D Plant Phenotyping: 3D Foundation Models Enable Minute-to-Second Cross-Crop Reconstruction and Beyond

Add code
Jul 02, 2026
Viaarxiv icon

Robust Provably Secure Image Steganography via Latent Iterative Optimization

Add code
Mar 10, 2026
Viaarxiv icon

DepthCropSeg++: Scaling a Crop Segmentation Foundation Model With Depth-Labeled Data

Add code
Jan 18, 2026
Viaarxiv icon

Crowded Video Individual Counting Informed by Social Grouping and Spatial-Temporal Displacement Priors

Add code
Jan 03, 2026
Viaarxiv icon

FitControler: Toward Fit-Aware Virtual Try-On

Add code
Dec 30, 2025
Viaarxiv icon

Confidence-based Intent Prediction for Teleoperation in Bimanual Robotic Suturing

Add code
Apr 29, 2025
Viaarxiv icon

Roadside Monocular 3D Detection via 2D Detection Prompting

Add code
Apr 04, 2024
Figure 1 for Roadside Monocular 3D Detection via 2D Detection Prompting
Figure 2 for Roadside Monocular 3D Detection via 2D Detection Prompting
Figure 3 for Roadside Monocular 3D Detection via 2D Detection Prompting
Figure 4 for Roadside Monocular 3D Detection via 2D Detection Prompting
Viaarxiv icon

The Neglected Tails of Vision-Language Models

Add code
Feb 02, 2024
Figure 1 for The Neglected Tails of Vision-Language Models
Figure 2 for The Neglected Tails of Vision-Language Models
Figure 3 for The Neglected Tails of Vision-Language Models
Figure 4 for The Neglected Tails of Vision-Language Models
Viaarxiv icon

Long-Tailed 3D Detection via 2D Late Fusion

Add code
Dec 18, 2023
Viaarxiv icon