Picture for Bryan Catanzaro

Bryan Catanzaro

Allan

Audio-Visual Flamingo: Open Audio-Visual Intelligence for Long and Complex Videos

Add code
Jul 17, 2026
Viaarxiv icon

Unified Audio Intelligence Without Regressing on Text Intelligence

Add code
Jul 06, 2026
Viaarxiv icon

RADIO1D: Elastic Representations for Condensed Vision Modeling

Add code
Jul 03, 2026
Viaarxiv icon

Nemotron-Labs-TwoTower: Diffusion Language Modeling with Pretrained Autoregressive Context

Add code
Jun 29, 2026
Viaarxiv icon

Nemotron-TwoTower: Diffusion Language Modeling with Pretrained Autoregressive Context

Add code
Jun 25, 2026
Viaarxiv icon

Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

Add code
Jun 12, 2026
Viaarxiv icon

Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence

Add code
Apr 27, 2026
Viaarxiv icon

Nemotron 3 Super: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

Add code
Apr 14, 2026
Viaarxiv icon

Audio Flamingo Next: Next-Generation Open Audio-Language Models for Speech, Sound, and Music

Add code
Apr 13, 2026
Viaarxiv icon

Nemotron-Cascade 2: Post-Training LLMs with Cascade RL and Multi-Domain On-Policy Distillation

Add code
Mar 19, 2026
Viaarxiv icon