Skip to content
AI Atlas
ModelActive

Nemotron 3 Ultra

NVIDIA

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...

Updated 22 min ago · first seen 11 Sept 2026

model_01M294WVXG0ZTDNK5X5S7V5438

Context
262.1K tokens
T2 · 22 min ago
Released
4 Jun 2026
T2 · 22 min ago

Specification

Release date
4 Jun 2026

Source:OpenRouter public model & pricing listingT2observed 22 min agomedium

Context window
262.1K tokens

Source:OpenRouter public model & pricing listingT2observed 22 min agomedium

Max output
32.8K tokens

Source:OpenRouter public model & pricing listingT2observed 22 min agomedium

Modalities
text

Source:OpenRouter public model & pricing listingT2observed 22 min agomedium

Input modalities
text

Source:OpenRouter public model & pricing listingT2observed 22 min agomedium

Output modalities
text

Source:OpenRouter public model & pricing listingT2observed 22 min agomedium

Hugging Face repo
nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16

Source:OpenRouter public model & pricing listingT2observed 22 min agomedium

Openrouter id
nvidia/nemotron-3-ultra-550b-a55b

Source:OpenRouter public model & pricing listingT2observed 22 min agomedium

Supported parameters
frequency_penalty, include_reasoning, logit_bias, max_tokens, min_p, presence_penalty, reasoning, reasoning_effort, repetition_penalty, response_format, seed, stop, structured_outputs, temperature, tool_choice, tools, top_k, top_p

Source:OpenRouter public model & pricing listingT2observed 22 min agomedium

Each value shows its source, tier and observation time. Conflicting claims are kept side by side and flagged — never averaged. How AI Atlas records facts →

Provenance

Attributed facts

13

Source tiers

T213

Freshest observation

22 min ago

Conflicts

None