News

Nvidia präsentiert Nemotron 3 Ultra als neues führendes offenes KI-Modell aus den USA

Nvidia präsentiert Nemotron 3 Ultra als neues führendes offenes KI-Modell aus den USA

Das Wichtigste in Kürze

  • Nvidia hat das Nemotron 3 Ultra Modell vorgestellt, das als das intelligenteste offene KI-Modell aus den USA gilt.
  • Das Modell verfügt über rund 550 Milliarden Parameter, wovon etwa 55 Milliarden aktiv genutzt werden.
  • Auf dem Artificial Analysis Intelligence Index erreicht Nemotron 3 Ultra 48 Punkte und übertrifft damit andere führende US-Modelle.
  • Trotz dieser Leistung bleibt es hinter chinesischen Modellen wie Kimi K2.6 zurück, das 54 Punkte erzielt.
  • Nemotron 3 Ultra zeichnet sich durch eine hohe Ausgabegeschwindigkeit von über 300 Tokens pro Sekunde aus, was deutlich schneller ist als viele vergleichbare Modelle.
  • Das Modell ist auf komplexe Planungs-, Argumentations- und Agenten-Workflows ausgelegt und soll die Kosten pro Inferenz um 30 % senken.
  • Die Veröffentlichung der Modellgewichte auf Plattformen wie Hugging Face und OpenRouter ist für den 4. Juni geplant.

Nvidias Nemotron 3 Ultra: Ein neuer Maßstab für offene KI-Modelle in den USA

Nvidia hat mit der Einführung des Nemotron 3 Ultra ein neues, leistungsstarkes Modell im Bereich der künstlichen Intelligenz präsentiert. Dieses Modell, das auf der Computex 2026 von CEO Jensen Huang vorgestellt wurde, positioniert sich als das bisher intelligenteste offene KI-Modell aus den Vereinigten Staaten. Mit einer beeindruckenden Anzahl von rund 550 Milliarden Parametern, von denen etwa 55 Milliarden zu einem bestimmten Zeitpunkt aktiv sind, setzt Nemotron 3 Ultra neue Standards in der amerikanischen KI-Landschaft.

Technische Spezifikationen und Leistungsbewertung

Das Nemotron 3 Ultra ist ein sogenanntes Mixture-of-Experts-Modell (MoE), das eine effiziente Nutzung der Ressourcen ermöglicht, indem nur relevante Teile des Modells für spezifische Aufgaben aktiviert werden. Diese Architektur, kombiniert mit NVFP4-Präzision und einer Hybrid Mamba-Transformer MoE-Architektur, soll eine hohe Leistung bei gleichzeitig optimiertem Ressourcenverbrauch gewährleisten.

Auf dem Artificial Analysis Intelligence Index erreichte Nemotron 3 Ultra einen Wert von 48 Punkten. Dies stellt eine signifikante Verbesserung gegenüber anderen offenen US-Modellen dar. Zum Vergleich: Gemma 4 31B erzielte 39 Punkte, Nemotron 3 Super 36 Punkte und gpt-oss-120b 33 Punkte. Diese Ergebnisse unterstreichen die führende Position des Nemotron 3 Ultra innerhalb der amerikanischen Open-Source-KI-Modelle.

Herausforderung durch internationale Konkurrenz

Trotz seiner herausragenden Stellung in den USA sieht sich Nemotron 3 Ultra im globalen Vergleich weiterhin starker Konkurrenz gegenüber. Insbesondere chinesische Modelle zeigen eine noch höhere Leistungsfähigkeit. Kimi K2.6 von Moonshot AI beispielsweise erreicht auf dem Artificial Analysis Intelligence Index 54 Punkte und liegt damit noch vor Nvidias neuem Modell. Das derzeit stärkste geschlossene Modell, Opus 4.8, erzielt sogar 61 Punkte.

Diese Diskrepanz verdeutlicht die Dynamik und den intensiven Wettbewerb im globalen KI-Sektor, in dem Innovationen und Fortschritte mit hoher Geschwindigkeit vorangetrieben werden. Die Entwicklung offener Modelle spielt dabei eine zentrale Rolle, da sie die Zugänglichkeit und Weiterentwicklung von KI-Technologien für eine breitere Entwicklergemeinschaft fördern.

Geschwindigkeit und Effizienz im Fokus

Ein weiteres herausragendes Merkmal des Nemotron 3 Ultra ist seine hohe Ausgabegeschwindigkeit. Laut Angaben von Artificial Analysis liefert das Modell über 300 Tokens pro Sekunde auf der DeepInfra-Plattform. Dies ist ein bemerkenswerter Wert, der im Vergleich zu ähnlich großen chinesischen Modellen, die oft nur 50 bis 100 Tokens pro Sekunde erreichen, eine drei- bis sechsfache Beschleunigung darstellt.

Diese Geschwindigkeit ist nicht nur ein Indikator für technische Leistungsfähigkeit, sondern hat auch direkte Auswirkungen auf die Einsatzmöglichkeiten. Eine schnellere Inferenzzeit kann die Kosten für KI-Anwendungen erheblich senken. Nvidia gibt an, dass Nemotron 3 Ultra die Kosten pro Inferenz für Unternehmen um bis zu 30 % reduzieren kann, was es zu einer attraktiven Option für anspruchsvolle Unternehmensanwendungen macht.

Anwendungsbereiche und Verfügbarkeit

Nemotron 3 Ultra ist primär für komplexe Planungs-, Argumentations- und Agenten-Workflows konzipiert. Dies umfasst Szenarien, in denen KI-Modelle nicht nur Informationen verarbeiten, sondern auch proaktiv Entscheidungen treffen und Aktionen ausführen müssen. Das Modell ist als Basis-Modell-Checkpoint vorgesehen und eignet sich für Downstream-Feinabstimmungen und RLHF (Reinforcement Learning from Human Feedback) Forschung.

Die Veröffentlichung der Modellgewichte ist für den 4. Juni auf verschiedenen Plattformen wie Hugging Face und OpenRouter angekündigt. Dies unterstreicht Nvidias Engagement für die Open-Source-Gemeinschaft und ermöglicht es Entwicklern weltweit, das Modell zu nutzen, anzupassen und weiterzuentwickeln.

Fazit und Ausblick

Nvidias Nemotron 3 Ultra stellt einen bedeutenden Fortschritt für offene KI-Modelle aus den USA dar. Seine hohe Intelligenz, beeindruckende Geschwindigkeit und das Potenzial zur Kostensenkung machen es zu einem wichtigen Werkzeug für Unternehmen und Forscher. Obwohl es im globalen Vergleich noch von einigen chinesischen Modellen übertroffen wird, markiert es einen Meilenstein in der Entwicklung offener KI-Technologien in den Vereinigten Staaten. Der weitere Wettbewerb und die kontinuierliche Innovation in diesem Bereich werden voraussichtlich zu noch leistungsfähigeren und effizienteren KI-Lösungen führen.

Bibliography

- "Nemotron 3 Ultra announced: high-speed, leading US open weights intelligence" - Artificial Analysis, 1. Juni 2026 - "Nvidia Unveils Nemotron 3 Ultra, Top U.S. Open Model, but Ranks Below China's Kimi K2.6" - Gate News, 30. Mai 2026 - "Nvidia Releases Its Best Open AI Model Yet—But Still Lags Behind China" - Nation Online - "NVIDIA's 550B Nemotron Embarrassed Every US Open Model — and It Shouldn't Run This Fast" - Towards AI, 2. Juni 2026 - "Nvidia unveils Nemotron 3 Ultra: America’s smartest open-weights AI model, 30% cheaper to run" - The News, 1. Juni 2026 - "NVIDIA Nemotron 3 Ultra 550B: Developer Guide — Architecture, Benchmarks & Deployment" - DEV Community, 2. Juni 2026 - "NVIDIA Unveils Nemotron 3 Ultra: The Largest US Open‑S…" - BestHub, 1. Juni 2026 - "Nemotron 3 Ultra: NVIDIA's 550B Open Model" - Pasquale Pillitteri, 1. Juni 2026 - "Nemotron 3 Ultra: Nvidia’s Free Open AI Model" - Tbreak, 1. Juni 2026

KI, die in Deutschland zu Hause ist.

Testen Sie Mindverse Studio oder sprechen Sie mit unserem Team über Ihren Anwendungsfall.