Beobachtetes Signal · 2. Juni 2026 · Product Launch · Quelle: AINews swyx · Relevanz: 4/5 · Sentiment: Positiv
NVIDIA stellt Cosmos 3, Nemotron 3 Ultra und RTX Spark vor
NVIDIA hat mehrere wegende KI-Produkte vorgestellt, darunter Cosmos 3 – eine offene, omnimodale Modellfamilie für Weltmodelle, die Sprache, Bild, Video, Audio und Aktion vereint. Hinzu kommen das große Open-Weight-MoE-LLM Nemotron 3 Ultra sowie der persönliche KI-Superchip RTX Spark. Cosmos 3 erscheint als Full-Stack-Release mit Nano- (16B) und Super-Varianten (64B) in einer Mixture-of-Transformers-Architektur. Nemotron 3 Ultra ist ein MoE 550B-A55B-Modell mit hohem Serving-Throughput. Zudem präsentierte NVIDIA den RTX Spark (ca. 1 PFLOP FP4) gemeinsam mit Microsoft und gründete die Cosmos Coalition, um ein offenes Ökosystem für Weltmodelle zu fördern. Flankierend gab es multimodale Releases von MiniMax, Alibaba und JetBrains, was den allgemeinen Trend zu Agenten-Runtimes und lokalen Inferenz-Tools unterstreicht.
Bedeutende technische Releases von NVIDIA bei Modellen und Hardware sowie die breite Ökosystem-Aktivität beeinflussen die Modellverfügbarkeit, lokale Inferenz und Infrastruktur-Entscheidungen für MarTech- und AdTech-Anbieter.
Marktsignale zu NVIDIA in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- NVIDIA launchte Cosmos 3, eine offene Familie omnimodaler Weltmodelle, die Sprache, Bild, Video, Audio und Aktion in einer Mixture-of-Transformers-Architektur vereinen.
- Die Cosmos-3-Modellvarianten umfassen Nano (16B) und Super (64B); letztere ist für Text2Image und Image2Video feingetunt.
- Mit Nemotron 3 Ultra wurde ein offenes MoE 550B-A55B LLM mit Berichten über hohen Serving-Throughput angekündigt.
- NVIDIA zeigte den persönlichen KI-Superchip RTX Spark (ca. 1 PFLOP FP4, bis zu 128 GB Unified Memory) mit Microsoft als Partner.
- Cosmos 3 wurde als vollständiges Open-Stack-Release (Gewichte, Code, Datensätze, Fine-Tuning-Rezepte) nebst der Cosmos Coalition veröffentlicht.
Verknüpfte Unternehmen
9 verknüpfte UnternehmenOntologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
NVIDIA veröffentlicht Nemotron 3 Ultra mit Mamba-Transformer-Architektur
Am 4. Juni 2026 hat NVIDIA mit Nemotron 3 Ultra ein hybrides Mamba-Transformer Mixture-of-Experts-Modell mit 550 Milliarden Parametern veröffentlicht, das rund 55 Milliarden aktive Parameter pro Token und ein Kontextfenster von einer Million Token bietet. Das Modell wurde mittels NVFP4 auf NVIDIAs Blackwell-Architektur trainiert und nutzt einen hardwareoptimierten LatentMoE-Router. Unabhängige Benchmarks von Artificial Analysis weisen einen Intelligence Index von 48 aus, während die Inferenzgeschwindigkeit auf einem DeepInfra-Endpunkt über 300 Token pro Sekunde erreicht. Das Modell ist über NIM Microservices, Hugging Face, OpenRouter und Cloud-Partner verfügbar. Für den Unternehmenseinsatz in Agenten-Workflows und nachgelagerten MarTech- sowie AdTech-Anwendungen sind insbesondere die OpenAI-kompatiblen API-Muster, Authentifizierungsdetails und die erforderliche Rechenleistung auf Basis von Multi-GPU-Infrastrukturen relevant.
NVIDIA: Chris Alexiuk über Nemotron, GPUs und Agentic AI
In einem Interview erläutert Chris Alexiuk von NVIDIA die Nemotron-Modellfamilie und deren gezielte Ausrichtung auf die hauseigene GPU-Hardware. Nemotron 3 erscheint in drei Stufen (Nano, Super, Ultra), die für Single-GPU-, Single-Node- sowie NVL72-Rack-Deployments optimiert sind. Die Architektur kombiniert Mamba-2-Schichten mit sparse Mixture-of-Experts (MoE) bei reduzierten Attention-Layern. Durch LatentMoE-Routing werden Tokens komprimiert, um bei gleichen Kosten rund viermal mehr Experten anzusteuern. Neben multimodalen Erweiterungen wie Nemotron 3 Nano Omni veröffentlicht NVIDIA umfangreiche Open-Data-Trainingsdaten parallel zu den Modellgewichten. Zudem wurde Nemotron 3.5 Lightning vorgestellt – ein 30B-MoE-Modell (3B aktiv), das speziell für Agentic-AI-Workloads konzipiert ist und Speculative Decoding sowie NVFP4-Quantisierung nutzt. NVIDIAs Strategie zielt darauf ab, das breite Open-Source-Ökosystem zu stärken, anstatt als Closed-Model-Anbieter aufzutreten.
Nvidia stellt Cosmos 3 als Weltmodell für Robotik vor
Nvidia hat mit Cosmos 3 ein neues sogenanntes Weltmodell für Robotik und autonome Systeme angekündigt, das Simulation, Szenenverständnis und Aktionsplanung in einem einzigen Foundation Model vereint. Weltmodelle sind 3D-virtuelle Umgebungen, mit denen Agenten oder Nutzer über Prompts interagieren können. Diese Veröffentlichung reiht sich ein neben DeepMinds Genie 3 vom August 2025, welches interaktive 3D-Welten in Echtzeit generiert. Zudem beleuchtet der Beitrag wissenschaftliche Debatten darüber, ob Large Language Models über interne Weltmodelle verfügen, verweist auf Perspektiven des Reinforcement Learning und der Meta-Analyse von Matthew Botvinick und beschreibt Yann LeCuns JEPA-Architektur als alternativen Ansatz für abstraktere interne Repräsentationen. Der ursprüngliche Artikel vom 14. August 2025 wurde am 3. Juni 2026 hinsichtlich Cosmos 3 aktualisiert.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
