Picture for Loris Bazzani

Loris Bazzani

ProMoE-FL: Prototype-conditioned Mixture of Experts for Multimodal Federated Learning with Missing Modalities

Add code
Jul 07, 2026
Viaarxiv icon

Interactive Episodic Memory with User Feedback

Add code
Apr 27, 2026
Viaarxiv icon

Benchmarking Interaction, Beyond Policy: a Reproducible Benchmark for Collaborative Instance Object Navigation

Add code
Mar 31, 2026
Viaarxiv icon

Med-MMFL: A Multimodal Federated Learning Benchmark in Healthcare

Add code
Feb 04, 2026
Viaarxiv icon

ToFu: Visual Tokens Reduction via Fusion for Multi-modal, Multi-patch, Multi-image Task

Add code
Mar 06, 2025
Figure 1 for ToFu: Visual Tokens Reduction via Fusion for Multi-modal, Multi-patch, Multi-image Task
Figure 2 for ToFu: Visual Tokens Reduction via Fusion for Multi-modal, Multi-patch, Multi-image Task
Figure 3 for ToFu: Visual Tokens Reduction via Fusion for Multi-modal, Multi-patch, Multi-image Task
Figure 4 for ToFu: Visual Tokens Reduction via Fusion for Multi-modal, Multi-patch, Multi-image Task
Viaarxiv icon

UniCoRN: Unified Commented Retrieval Network with LMMs

Add code
Feb 12, 2025
Viaarxiv icon

Learning Visual Hierarchies with Hyperbolic Embeddings

Add code
Nov 26, 2024
Viaarxiv icon

LatteCLIP: Unsupervised CLIP Fine-Tuning via LMM-Synthetic Texts

Add code
Oct 10, 2024
Figure 1 for LatteCLIP: Unsupervised CLIP Fine-Tuning via LMM-Synthetic Texts
Figure 2 for LatteCLIP: Unsupervised CLIP Fine-Tuning via LMM-Synthetic Texts
Figure 3 for LatteCLIP: Unsupervised CLIP Fine-Tuning via LMM-Synthetic Texts
Figure 4 for LatteCLIP: Unsupervised CLIP Fine-Tuning via LMM-Synthetic Texts
Viaarxiv icon

ViewFusion: Towards Multi-View Consistency via Interpolated Denoising

Add code
Feb 29, 2024
Figure 1 for ViewFusion: Towards Multi-View Consistency via Interpolated Denoising
Figure 2 for ViewFusion: Towards Multi-View Consistency via Interpolated Denoising
Figure 3 for ViewFusion: Towards Multi-View Consistency via Interpolated Denoising
Figure 4 for ViewFusion: Towards Multi-View Consistency via Interpolated Denoising
Viaarxiv icon

iEdit: Localised Text-guided Image Editing with Weak Supervision

Add code
May 10, 2023
Viaarxiv icon