Reasoning Tools Open weights

Fast NVIDIA Nemotron MoE for reliable agentic tasks across enterprise workloads

nvidia/nemotron-3.5-lightning 2026-08-11 262.144K context $0.05/M input $0.2/M output
10 providers
Reasoning Tools JSON Open weights

Fast NVIDIA Nemotron MoE for reliable agentic tasks across enterprise workloads

nvidia/nemotron-3.5-lightning-30b-a3b 2026-08-11 262.144K context Input not listed Output not listed
2 providers
Reasoning Tools Open weights

Largest Nemotron 3 model for maximum open-weight reasoning and agent accuracy

nvidia/nemotron-3-ultra-550b-a55b 2026-06-04 1M context $0.5/M input $2.5/M output
15 providers
Reasoning Tools Open weights

Open Nemotron omni model combining reasoning with text, vision, and audio

nvidia/nemotron-3-nano-omni-30b-a3b-reasoning 2026-04-28 256K context $0.2/M input $0.8/M output
5 providers
Reasoning Open weights

Nemotron middle tier for collaborative agents and high-volume reasoning workloads

nvidia/nemotron-3-super-120b-a12b 2026-03-11 262.144K context $0.2/M input $0.8/M output
15 providers
Open weights

Small Nemotron 3 MoE for efficient coding, math, and long-context agents

nvidia/nemotron-3-nano-30b-a3b 2025-12-15 262.144K context $0.05/M input $0.2/M output
11 providers
Reasoning Tools Open weights

Nemotron model for efficient reasoning, coding, and specialized AI agents

nvidia/llama-3.3-nemotron-super-49b-v1.5 2025-07-25 131.072K context $0.4/M input $0.4/M output
4 providers
Reasoning Tools Open weights

Flagship Nemotron model for high-throughput reasoning and complex agents

nvidia/llama-3.1-nemotron-ultra-253b 2025-04-07 128K context Input not listed Output not listed
2 providers