Picture for Juan Fang

Juan Fang

Bridging Severe Cross-Modal Misalignment: End-to-End Visible-Infrared Object Detection via Explicit Feature-Domain Affine Registration

Add code
Aug 11, 2026
Viaarxiv icon

InterPruner: Interactive Structured Pruning via Taylor-Implicit Criterion and Language-Prior Modulator for Multimodal Object Detection

Add code
Aug 11, 2026
Viaarxiv icon

eX-ViT: A Novel eXplainable Vision Transformer for Weakly Supervised Semantic Segmentation

Add code
Jul 12, 2022
Figure 1 for eX-ViT: A Novel eXplainable Vision Transformer for Weakly Supervised Semantic Segmentation
Figure 2 for eX-ViT: A Novel eXplainable Vision Transformer for Weakly Supervised Semantic Segmentation
Figure 3 for eX-ViT: A Novel eXplainable Vision Transformer for Weakly Supervised Semantic Segmentation
Figure 4 for eX-ViT: A Novel eXplainable Vision Transformer for Weakly Supervised Semantic Segmentation
Viaarxiv icon