NVIDIA-Logo

NVIDIA

Nemotron 3 Ultra

FrontierOpen-weightAvailable in FlowHunt

Nemotron 3 Ultra ist ein erstklassiges Frontier-KI-Modell, entwickelt von NVIDIA und veröffentlicht im Juni 2026. Als Open-Weight-Modell sind seine trainierten Gewichte öffentlich verfügbar – Sie können es selbst hosten, auf proprietären Daten feintunen oder vor Ort ohne API-Abhängigkeiten betreiben. Es unterstützt ein Kontextfenster von 262.000 Tokens, ausreichend für die meisten Dokumente und mehrteilige Anwendungen.

Auf dem FlowHunt AI Leaderboard ist es eines von 24 verfolgten Modellen, evaluiert auf 2 Benchmarks. Herausragende Ergebnisse: 48,0 Punkte auf dem AA Intelligence Index (#7 von 9); 86,7 % auf GPQA Diamond (#9 von 14).

Nemotron 3 Ultra wurde am 4. Juni 2026 als NVIDIAs führendes Open-Weight-Sprachmodell veröffentlicht, konzipiert für den Einsatz auf Blackwell-Generation-GPU-Clustern (B200, GB200 NVLink). Mit 55B aktiven Parametern aus einem 550B großen MoE-Gesamtpool wurde Ultra entwickelt, um die Genauigkeit auf NVIDIA-Hardware mithilfe von TensorRT-LLMs Blackwell-spezifischen Optimierungen zu maximieren. Zum Zeitpunkt der Veröffentlichung hielt es den höchsten Artificial Analysis Intelligence Index Score aller vollständigen Open-Weight-Modelle – was es zum Benchmark-Referenzpunkt für Unternehmenskunden machte, die in NVIDIAs Blackwell-Infrastruktur investierten und ein enthaltenes, inferenzoptimiertes Modell zusammen mit ihrem Hardwarekauf haben wollten.

Hinweis: Das intelligenteste US-Open-Weight-Modell. Optimiert für NVIDIA Blackwell.

Veröffentlicht
Juni 2026
Parameter
55B/550B MoE
Kontext
262.000 Tokens
Gewichte
Offen
Stufe
Frontier
Anbieter
NVIDIA

Nemotron 3 Ultra Benchmark Rankings

Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.

BenchmarkScoreRankSourceWhat it measures
GPQA Diamond86.7%9 of 14SRGraduate-level Google-proof science Q&A
AA Intelligence Index48.0 pts7 of 9AAArtificial Analysis composite score (independent)

Detailed Benchmark Scores

GPQA ◇ SR
86.7%
Graduate-level Google-proof science Q&A
AA Idx AA
48.0 pts
Artificial Analysis composite score (independent)

Nemotron 3 Ultra vs. Frontier Peers

Head-to-head benchmark comparison with other Frontier-tier models. Higher is better for all metrics.

BenchmarkNemotron 3 UltraClaude Opus 4.8Claude Opus 4.7
GPQA ◇86.7%93.6%94.2%
AA Idx48.0 pts61.4 pts57.3 pts

About NVIDIA

NVIDIA Founded 1993 · Santa Clara, CA
Website →

NVIDIA Corporation entwickelt und verkauft Grafikprozessoren (GPUs) und System-on-Chip-Einheiten, die weltweit zur dominanten Hardware-Plattform für KI-Modelltraining und Inferenz geworden sind, mit einem geschätzten Marktanteil von 80 bis 95 Prozent bei KI-Beschleunigern in Rechenzentren. Das 1993 von Jensen Huang, Chris Malachowsky und Curtis Priem gegründete Unternehmen hat sich von seinem ursprünglichen Fokus auf Gaming-Grafik zu einem Full-Stack-KI-Computing-Unternehmen entwickelt. Die Nemotron-Modellfamilie spiegelt eine vertikale Integrationsstrategie wider: Durch die Veröffentlichung von Open-Weight-Modellen, die speziell für NVIDIA-Hardware optimiert sind, will das Unternehmen den Wert seiner Blackwell-Generation von GPU-Clustern demonstrieren und gleichzeitig das Open-Weight-Ökosystem um NVIDIA-optimierte Software-Stacks herum formen.

Anwendungsfälle

Wofür Nemotron 3 Ultra verwenden

Wissenschaftliches & Technisches Denken
Selbstgehostete & Private Bereitstellungen

Strengths & Limitations

Strengths

  • Fortschrittliche wissenschaftliche Q&A – 86 % GPQA Diamond
  • Selbstgehostete & datenschutzfreundliche Bereitstellungen (Open-Weight)
  • Langkontext-Aufgaben (262.000 Tokens Kontextfenster)

Das vollständige KI-Modell-Ranking durchsuchen

Häufig gestellte Fragen

Mehr erfahren

MiniMax M3 — Benchmarks, Fähigkeiten und Anwendungsfälle
MiniMax M3 — Benchmarks, Fähigkeiten und Anwendungsfälle

MiniMax M3 — Benchmarks, Fähigkeiten und Anwendungsfälle

MiniMax M3 ist ein Open-Weight-KI-Modell von MiniMax (MoE (nicht offengelegt)), das als Frontier-Stufe eingestuft wird und über ein Kontextfenster von 1 Million...

4 Min. Lesezeit