Picture for Marcella Cornia

Marcella Cornia

Segmenting, Fast and Slow: Real-Time Open-Vocabulary Video Instance Segmentation with Dual-Path Processing

Add code
Jun 30, 2026
Viaarxiv icon

Mind the Heads: Topological Representation Alignment for Multimodal LLMs

Add code
Jun 22, 2026
Viaarxiv icon

Diffusion Language Models: An Experimental Analysis

Add code
Jun 17, 2026
Viaarxiv icon

Do Models Share Safety Representations? Cross-Model Steering for Safe Visual Generation

Add code
Jun 03, 2026
Viaarxiv icon

Few Channels Draw The Whole Picture: Revealing Massive Activations in Diffusion Transformers

Add code
May 13, 2026
Viaarxiv icon

GramSR: Visual Feature Conditioning for Diffusion-Based Super-Resolution

Add code
Apr 28, 2026
Viaarxiv icon

RaTA-Tool: Retrieval-based Tool Selection with Multimodal Large Language Models

Add code
Apr 16, 2026
Viaarxiv icon

Look Twice: Training-Free Evidence Highlighting in Multimodal Large Language Models

Add code
Apr 01, 2026
Viaarxiv icon

Tiny Inference-Time Scaling with Latent Verifiers

Add code
Mar 25, 2026
Viaarxiv icon

Dress-ED: Instruction-Guided Editing for Virtual Try-On and Try-Off

Add code
Mar 23, 2026
Viaarxiv icon