Picture for Ido Galil

Ido Galil

Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs

Add code
Jul 05, 2026
Viaarxiv icon

Evaluating LLM Uncertainty in Long-Form Generation Using Deterministic Ground Truth

Add code
Jul 04, 2026
Viaarxiv icon

Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

Add code
Jun 12, 2026
Viaarxiv icon

Nemotron 3 Super: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

Add code
Apr 14, 2026
Viaarxiv icon

When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation

Add code
Feb 13, 2026
Viaarxiv icon

Extending Puzzle for Mixture-of-Experts Reasoning Models with Application to GPT-OSS Acceleration

Add code
Feb 12, 2026
Viaarxiv icon

NVIDIA Nemotron 3: Efficient and Open Intelligence

Add code
Dec 24, 2025
Viaarxiv icon

Llama-Nemotron: Efficient Reasoning Models

Add code
May 02, 2025
Figure 1 for Llama-Nemotron: Efficient Reasoning Models
Figure 2 for Llama-Nemotron: Efficient Reasoning Models
Figure 3 for Llama-Nemotron: Efficient Reasoning Models
Figure 4 for Llama-Nemotron: Efficient Reasoning Models
Viaarxiv icon

FFN Fusion: Rethinking Sequential Computation in Large Language Models

Add code
Mar 24, 2025
Viaarxiv icon

No Data, No Optimization: A Lightweight Method To Disrupt Neural Networks With Sign-Flips

Add code
Feb 11, 2025
Viaarxiv icon