Die Geschichte von NVIDIA

NVIDIA · Quellenbelegte Chronik

Die Geschichte von NVIDIA

Von der GPU-Schmiede über CUDA und AlexNet zu Mellanox, Blackwell, Vera Rubin und Nemotron 3 Ultra — wie NVIDIA zum Compute-Fundament des KI-Zeitalters und zum wertvollsten Unternehmen der Welt wurde.

Position · September 2026Infrastruktur-Machtdas Compute-Fundament des KI-Zeitalters
Stand: 7. September 2026
0Ereignisse
1993–2633 Jahre
0Architekturen
0Quellen-Belege

Konfidenz-Kennzeichnung

  • Faktum (belegt)
  • 🟡 teilweise belegt
  • 🔵 Interpretation

Kategorien

  • Unternehmen
  • Hardware
  • Infrastruktur
  • Forschung
  • Modell
  • Finanzen
  • Kontroverse
Interaktiv · in Kapiteln

Zeitleiste

Vier Kapitel von der Gründung 1993 über CUDA und AlexNet bis zu Vera Rubin in voller Produktion, Nemotron 3 Ultra und den Rekordzahlen 2026. Filtere nach Kategorie oder durchsuche alle Ereignisse — jeder Eintrag führt seine Quellen mit.

Ära 01 · 1993–2011

Gründung, GPU & CUDA

Vom Denny's-Start über den GPU-Begriff bis zur strategischen Wette CUDA.

Unternehmenbelegt

Gründung von NVIDIA

Jensen Huang, Chris Malachowsky und Curtis Priem gründen NVIDIA. Aus einer Grafikchip-Firma wird später die zentrale Infrastrukturplattform des KI-Zeitalters.

Hardwarebelegt

GeForce 256 und der Begriff GPUGeForce 256

Mit GeForce 256 prägt NVIDIA den Begriff Graphics Processing Unit. Die massive Parallelität von Grafikchips wird später zur Grundlage für GPU-Deep-Learning.

Schlüsselmoment
Forschungbelegt

Die strategischste Entscheidung der Firmengeschichte — der Software-Burggraben.

CUDA macht GPUs programmierbarCUDA

CUDA macht NVIDIA-GPUs für allgemeine parallele Berechnungen nutzbar. Diese Softwareentscheidung wird später zum Kern des KI-Burggrabens.

Hintergrund

Im November 2006 lancierte NVIDIA mit der GeForce 8800 GTX CUDA — und machte GPUs erstmals in Standard-C für beliebige parallele Berechnungen programmierbar, nicht nur für Grafik. Jensen Huang ordnete an, CUDA in jede NVIDIA-GPU zu integrieren, vom Budget-Chip bis zur Workstation. Die Entscheidung kostete jahrelang Milliarden an R&D, baute aber einen Software-Graben auf, der heute schwerer zu überwinden ist als jeder Chip-Vorsprung: cuDNN, NCCL, TensorRT, NIM und Dynamo bauen alle darauf auf, und über vier Millionen Entwickler programmieren auf CUDA.

Im Kapitel weiterlesen →
Ära 02 · 2012–2019

Der Deep-Learning-Funke

AlexNet, DGX-1 für OpenAI und die Tensor Cores.

Schlüsselmoment
Forschungbelegt

Der Funke: GPU-Deep-Learning gewinnt ImageNet — auf zwei Consumer-Karten.

AlexNet beweist GPU-Deep-Learning

AlexNet gewinnt ImageNet mit großem Vorsprung und wird auf zwei NVIDIA GTX 580 trainiert. Das macht GPU-beschleunigtes Deep Learning praktisch sichtbar.

Hintergrund

Im Herbst 2012 gewann AlexNet — entwickelt von Alex Krizhevsky, Ilya Sutskever und Geoffrey Hinton — den ImageNet-Wettbewerb mit großem Vorsprung, trainiert auf nur zwei NVIDIA GTX 580. Die Arbeit zeigte, dass GPU-beschleunigtes Deep Learning konventionellen Methoden überlegen ist. NVIDIA hatte diesen Wandel nicht selbst initiiert, aber seine Hardware ermöglichte ihn — und das Unternehmen richtete sich daraufhin konsequent auf KI-Compute aus.

Im Kapitel weiterlesen →
Hardwarebelegt

DGX-1DGX-1

NVIDIA stellt DGX-1 als integrierten KI-Supercomputer vor. Die frühe DGX-Verbindung zu OpenAI wird später zum Symbol der NVIDIA/OpenAI-Compute-Beziehung.

Ära 03 · 2020–2024

Datacenter-Stack & Architektur-Generationen

Mellanox, A100, H100/H200, die ChatGPT-Explosion, Blackwell — und 3 Billionen Börsenwert.

Schlüsselmoment
Infrastrukturbelegt

Der unterschätzte Kauf, der NVIDIA rack-scale machte.

Mellanox-Übernahme

NVIDIA schließt die Übernahme von Mellanox für rund 7 Mrd. USD ab. Damit wird Netzwerk- und Scale-out-Kompetenz ein Kernbestandteil des KI-Stacks.

Hintergrund

Am 27. April 2020 schloss NVIDIA die rund 7 Mrd. USD teure Übernahme von Mellanox ab — in der KI-Geschichte oft unterschätzt. Für große Sprachmodelle zählt nicht nur die Leistung einer einzelnen GPU, sondern das Verbinden tausender GPUs zu einem System: Latenz, Topologie, Bandbreite, Kühlung. Mellanox brachte InfiniBand und Hochleistungsnetzwerke und legte damit das Fundament für NVIDIAs spätere Rack-Scale-Systeme wie GB200 NVL72. Strategisch war Mellanox fast so wichtig wie A100 oder H100.

Im Kapitel weiterlesen →
Hardwarebelegt

A100 (Ampere)A100

A100 wird das erste große Datacenter-Flaggschiff der modernen KI-Ära und dominiert frühe LLM-Trainingscluster.

Schlüsselmoment
Hardwarebelegt

Der Motor der LLM-Ära — nach ChatGPT die begehrteste Ressource der Branche.

H100 (Hopper)H100

H100 wird zum zentralen LLM-Beschleuniger der ChatGPT-Ära. Hopper bringt unter anderem FP8-Unterstützung und starke Transformer-Leistung.

Hintergrund

Die H100 (Hopper, 2022) bot deutlich höhere Transformer-Leistung als die A100 und führte das FP8-Datenformat für LLM-Training ein. Als ChatGPT im November 2022 erschien, explodierte die Nachfrage: H100-GPUs waren bis Ende 2023 nahezu unbeschaffbar, mit Wartezeiten von sechs bis zwölf Monaten. Die H100 wurde zum Sinnbild des Compute-Engpasses, der das gesamte KI-Rennen prägte — und zum Motor von NVIDIAs historischem Umsatz-Steilflug. Die H200 (November 2023) erweiterte Hopper um HBM3e-Speicher (141 GB, 4,8 TB/s).

Im Kapitel weiterlesen →
Hardwarebelegt

H200 mit HBM3eH200

NVIDIA erweitert Hopper mit H200. Das Modell bietet laut NVIDIA 141 GB HBM3e und 4,8 TB/s Bandbreite für generative KI und HPC.

Schlüsselmoment
Hardwarebelegt

GB200 NVL72 — das leistungsfähigste kommerzielle KI-System.

Blackwell und GB200 NVL72Blackwell / GB200 NVL72

NVIDIA stellt Blackwell vor. GB200 NVL72 verschiebt den Fokus von Einzel-GPUs zu rack-scale KI-Supercomputern mit 72 GPUs.

Hintergrund

Blackwell (März 2024) kombiniert zwei Chips zu einer logischen GPU mit 208 Milliarden Transistoren. Das flüssigkeitsgekühlte GB200 NVL72 — ein Rack mit 72 Blackwell-GPUs und 36 Grace-CPUs — gilt als eines der leistungsfähigsten kommerziell verfügbaren KI-Systeme; NVIDIA nennt 25-fache Leistung pro Watt gegenüber H100 (Eigenangabe). 2024 gab es allerdings Berichte über Design-, Ramp- und Thermalprobleme; Jensen Huang bestätigte später einen behobenen Designfehler. Bis 2025 meldete NVIDIA NVL72 in voller Produktion — kein problemloser Start, aber ein gelungener Hochlauf.

Im Kapitel weiterlesen →
Ära 04 · 2025–2026

KI-Nervensystem der Welt

Voller Stack, Nemotron 3 Ultra, Vera Rubin in Produktion, Mega-Deals, China-Rinnsal, Rekordzahlen und ~5,6 Billionen USD.

Modellbelegt

Dynamo, GR00T N1 und Blackwell UltraDynamo / GR00T N1 / Blackwell Ultra

Auf der GTC 2025 zeigt NVIDIA Dynamo für Reasoning-Inferenz, Isaac GR00T N1 für humanoide Robotik und Blackwell Ultra/Vera-Rubin-Roadmap.

Kontroversebelegt

H20 wird lizenzpflichtigH20

Die USA machen H20-Exporte nach China lizenzpflichtig. NVIDIA verbucht in Q1 FY2026 eine 4,5-Mrd.-USD-Belastung und kann zusätzlich 2,5 Mrd. USD H20-Umsatz nicht ausliefern.

Infrastrukturbelegt

NVLink FusionNVLink Fusion

NVIDIA öffnet NVLink Fusion für semi-custom AI Infrastructure. Partner können CPUs, Custom-ASICs und NVIDIA-Netzwerk/Software enger verbinden.

Unternehmenbelegt

Intel-Partnerschaft und 5-Mrd.-USD-Investmentx86 RTX / NVIDIA custom CPUs

NVIDIA und Intel kündigen gemeinsame Datacenter- und PC-Produkte an; NVIDIA soll 5 Mrd. USD in Intel-Aktien investieren.

Schlüsselmoment
Infrastrukturbelegt

Bis zu 100 Mrd. USD und 10 Gigawatt — der größte Compute-Deal der KI-Geschichte (zunächst Letter of Intent).

OpenAI-Partnerschaft über 10 GWVera Rubin

OpenAI und NVIDIA kündigen eine strategische Partnerschaft an: mindestens 10 GW NVIDIA-Systeme und bis zu 100 Mrd. USD NVIDIA-Investition, progressiv je Gigawatt. Es handelt sich zunächst um eine Absichtserklärung.

Hintergrund

Am 22. September 2025 kündigten NVIDIA und OpenAI eine strategische Partnerschaft an: NVIDIA will progressiv bis zu 100 Mrd. USD in OpenAI investieren, sobald Gigawatt-Phasen ausgerollt werden, verknüpft mit mindestens zehn Gigawatt NVIDIA-Infrastruktur für OpenAIs nächste Modellgeneration; die erste Phase soll in der zweiten Jahreshälfte 2026 mit der Vera-Rubin-Plattform anlaufen. OpenAI formulierte dies zunächst als Letter of Intent — Details sollten später finalisiert werden. Es ist dennoch der bislang größte Compute-Deal der KI-Geschichte und zeigt, wie tief NVIDIA mit den größten Modell-Laboren verflochten ist.

Im Kapitel weiterlesen →
Finanzenbelegt

FY2026: 215,9 Mrd. USD Umsatz

NVIDIA meldet für FY2026 215,9 Mrd. USD Umsatz, davon 193,7 Mrd. USD im Datacenter. Die Firma wird bilanziell zur KI-Infrastrukturmaschine.

Unternehmenteilw. belegt

OpenAI: 30 Mrd. statt 100-Mrd.-Konstrukt

Der bis zu 100 Mrd. USD schwere OpenAI-Letter-of-Intent vom September 2025 wird nie finalisiert. Stattdessen beteiligt sich NVIDIA Berichten zufolge mit rund 30 Mrd. USD an OpenAIs 122-Mrd.-USD-Runde bei 852 Mrd. USD Bewertung.

Hintergrund

Der 100-Mrd.-USD-LoI war an progressiv ausgerollte Gigawatt-Phasen geknüpft und wurde nach übereinstimmenden Berichten nie in eine endgültige Vereinbarung überführt; NVIDIA selbst bezeichnete die 100 Mrd. zuletzt als nie finalisiert. An ihre Stelle trat eine schlichtere Lösung: rund 30 Mrd. USD Direktinvestment im Rahmen der 122-Mrd.-USD-Runde vom 31. März 2026 (Ankerinvestoren berichtetermaßen Amazon ~50, NVIDIA ~30 und SoftBank ~30 Mrd. USD). Die 10-GW-Infrastrukturpartnerschaft selbst bleibt bestehen; ihre erste Phase soll mit der Vera-Rubin-Plattform anlaufen.

Im Kapitel weiterlesen →
Modellbelegt

Open Model Families 2026GR00T N1.7 / Cosmos 3 / Alpamayo 1.5

NVIDIA erweitert seine offenen Modellfamilien für agentische, physische und Healthcare-KI, darunter GR00T N1.7, Alpamayo 1.5 und Cosmos 3.

Schlüsselmoment
Finanzenteilw. belegt

Um die 5 Billionen USD — je nach Tag das wertvollste Unternehmen der Welt.

Börsenwert um bzw. über 5 Billionen USD

NVIDIAs Börsenwert bewegt sich 2026 je nach Tag und Quelle um bzw. über 5 Billionen USD. Die Einordnung als wertvollstes Unternehmen ist eine Momentaufnahme.

Hintergrund

Im April 2026 schloss NVIDIA erstmals oberhalb von 5 Billionen USD Börsenwert; 2026 bewegt sich der Wert je nach Tag und Quelle um bzw. über diese Marke — „wertvollstes Unternehmen der Welt“ ist daher eine Momentaufnahme, keine dauerhaft stabile Aussage. Getragen wird die Bewertung von einer der steilsten Wachstumskurven der Tech-Geschichte: Rekordumsatz von 215,9 Mrd. USD im Geschäftsjahr 2026 (193,7 Mrd. davon Rechenzentrum) und ein Q1-FY2027-Umsatz von 81,6 Mrd. USD (+85 % YoY), davon 75,2 Mrd. aus dem Rechenzentrum (+92 %). NVIDIA verdient nicht am besten Modell, sondern an der Hardware, auf der alle Modelle entstehen.

Im Kapitel weiterlesen →
Finanzenbelegt

Q1 FY2027: 81,6 Mrd. USD Umsatz

NVIDIA meldet 81,6 Mrd. USD Quartalsumsatz und 75,2 Mrd. USD Datacenter-Umsatz. Außerdem: 80 Mrd. USD zusätzliche Aktienrückkäufe, Dividendenerhöhung und neue Berichtslogik mit Data Center und Edge Computing.

Modellbelegt

Computex 2026: Nemotron 3 UltraNemotron 3 Ultra

Auf der Computex in Taipei kündigt NVIDIA Nemotron 3 Ultra an — das größte offene Nemotron-Modell: Mixture-of-Experts mit rund 550 Mrd. Parametern (55 Mrd. aktiv) und 1 Mio. Token Kontext. Berichte nennen es das intelligenteste Open-Weights-Modell eines US-Labors.

Hintergrund

Jensen Huang eröffnete die Computex-2026-Keynote am 1. Juni in Taipei mit dem Launch (zuvor per Teaser angekündigt); die offenen Gewichte folgten am 4. Juni 2026. NVIDIA positioniert Nemotron 3 Ultra für langlaufende Agenten: schnelleres Reasoning bei niedrigeren Kosten. Beobachter ordneten es als stärkstes offenes Modell eines US-Labors ein — weiterhin mit Abstand hinter den chinesischen Open-Weight-Spitzenmodellen. Damit baut NVIDIA seine Rolle als Modellanbieter weiter aus, ohne das Infrastruktur-Geschäftsmodell zu ändern.

Im Kapitel weiterlesen →
Infrastrukturbelegt

ISC 2026: Vera Rubin NVL4 und 35 neue KI-SupercomputerVera Rubin NVL4

Zur ISC High Performance 2026 kündigt NVIDIA Vera-Rubin-Systeme für Wissenschafts-Supercomputer an: NVL4-Systeme ab Q4 2026 über Systemhersteller, dazu ein Rekord von 35 neuen KI-HPC-Supercomputern in Europa.

Hintergrund

Das Vera-Rubin-NVL4-„Tray“ kombiniert 4 Rubin-GPUs und 2 Vera-CPUs (NVLink der sechsten Generation, NVLink-C2C), ist MGX-kompatibel und flüssigkeitsgekühlt; NVIDIA nennt gegenüber Grace Hopper 4× wissenschaftliche Simulationsleistung und 6× KI-Trainingsleistung für Wissenschaft (Firmenangaben). Parallel meldet NVIDIA einen Rekord von 35 neuen KI-HPC-Supercomputern in Entwicklung in Europa — Sovereign-AI-Infrastruktur wird zum eigenen Marktsegment.

Im Kapitel weiterlesen →
Hardwarebelegt

Vera Rubin läuft in die volle ProduktionVera Rubin / Spectrum-6

Vera Rubin ramped in die volle Produktion: Racks laufen bei CoreWeave, Google Cloud, Microsoft Azure, Oracle Cloud und Nebius; die Spectrum-6-Switches der Plattform treffen in den Gigascale-AI-Factories ein.

Hintergrund

Im Q2-FY2027-Bericht meldet NVIDIA die Vera-Rubin-Plattform in voller Produktion — Jensen Huang: „built to power exactly this moment“. Die Spectrum-6-Switch-Systeme (steckbare und co-packaged Optik) rollen weltweit aus; parallel kommen Vera (die erste für KI-Agenten gebaute CPU), BlueField-4 STX mit In-Silicon-Sicherheit und die DSX-Plattform als Bauplan für AI Factories. Blackwell führt unterdessen alle Kategorien der MLPerf-Training-6.0-Benchmarks an (NVIDIA-Angabe).

Im Kapitel weiterlesen →
Hardwarebelegt

NVIDIA Groq 3 LPX in voller ProduktionGroq 3 LPX

Der aus dem Groq-Deal hervorgegangene Inferenz-Beschleuniger Groq 3 LPX geht in die volle Produktion — ausgelegt auf niedriglatente Token-Generierung für KI-Agenten; Nebius will Racks noch 2026 anbieten.

Hintergrund

Hintergrund ist der rund 20 Mrd. USD schwere Deal vom Dezember 2025: NVIDIA lizenziert Groqs LPU-Technologie nicht-exklusiv und übernimmt Gründer Jonathan Ross sowie den Großteil des Teams; GroqCloud läuft unter neuem CEO unabhängig weiter. Aus dem Deal entstand die „NVIDIA Groq“-Produktlinie — NVIDIAs Antwort auf den Inferenz-Markt jenseits der eigenen GPU-Architektur.

Im Kapitel weiterlesen →
Schlüsselmoment
Finanzenbelegt

+106 % zum Vorjahr, 89 Mrd. Datacenter — und der Ausblick auf 108 Mrd. kommt weiterhin ohne einen Dollar China-Umsatz aus.

Q2 FY2027: 96,2 Mrd. USD Umsatz

NVIDIA meldet 96,2 Mrd. USD Quartalsumsatz (+106 % zum Vorjahr), davon 89,0 Mrd. USD Data Center (+117 %) und 7,2 Mrd. USD Edge Computing. Der Q3-Ausblick von 108 Mrd. USD enthält erneut keinen China-Data-Center-Compute-Umsatz.

Hintergrund

Bruttomarge 75,0 % (GAAP wie Non-GAAP), verwässerter GAAP-Gewinn je Aktie 2,46 USD, Nettogewinn 59,7 Mrd. USD. Rund 26 Mrd. USD wurden im Quartal über Rückkäufe und Dividenden an Aktionäre zurückgeführt; ~99 Mrd. USD Rückkauf-Autorisierung verbleiben. Gleichzeitig kündigte NVIDIA Compute-Finanzierungsplattformen mit Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs und KKR an, die über Zeit mehr als 500 Mrd. USD Drittkapital für den KI-Infrastruktur-Ausbau mobilisieren sollen (vorbehaltlich endgültiger Verträge) — plus Sovereign-AI-Programme mit Japan (erste nationale KI-Infrastruktur) und Korea (SK Telecom, NAVER, Brookfield im Gigawatt-Maßstab) sowie Vera-CPU-Einsatz bei SpaceXAI.

Im Kapitel weiterlesen →
Kontroverseteilw. belegt

China: H200-Rinnsal statt großer Rückkehr

H200-Exporte nach China laufen gegen eine 25-%-Abgabe nur schleppend an: Berichte nennen Auslieferungen von rund 13 % der bewilligten Quoten. Der US-Senat diskutiert mit dem AI OVERWATCH Act ein gesetzliches Blackwell-Verbot für China.

Hintergrund

Seit Anfang 2026 kann NVIDIA limitierte H200-Mengen nach China liefern — gegen eine Abgabe von 25 % und mit Quoten (Berichte nennen u. a. 75.000 Einheiten je für ByteDance und Tencent). Doch auch Peking bremst: Zoll und Behörden halten Käufer zurück, sodass nur ein Bruchteil der Quoten abgerufen wird; Chinas KI-Chip-Markt hat sich längst Richtung Huawei gedreht (Schätzungen sehen NVIDIAs Anteil im einstelligen Bereich). Im US-Senat liegt der AI OVERWATCH Act, der Verkäufe der Blackwell-Klasse an China für mindestens zwei Jahre gesetzlich sperren würde. NVIDIAs Q3-Ausblick enthält deshalb erneut keinen China-Data-Center-Umsatz.

Im Kapitel weiterlesen →
Keine Ereignisse für diese Auswahl.
Ausführliche Chronik
Tiefer einsteigen

Neun Teile mit Quellenkritik, Datierung und Einordnung — von der GPU-Erfindung über Mellanox und Blackwell bis zu Mega-Deals, Geopolitik und Rekordzahlen.

Zur ausführlichen Chronik →
Die Geschichte von NVIDIA — quellenbelegte Chronik, Stand 7. September 2026.
Inhaltlicher Anspruch: Fakten werden belegt, Unsicherheit benannt, Faktum von Deutung getrennt.