News

AWS und NVIDIA: 2 Millionen zusätzliche GPUs für agentenbasierte und physische KI 2027-2028

News | 01.09.2026

AWS und NVIDIA erweitern ihre 16-jährige Partnerschaft, um die stark wachsende Nachfrage nach Infrastruktur für agentenbasierte und physische KI zu bedienen.

Unternehmen, Forschungslabore und Behörden überführen KI-Workloads schneller vom Pilot in den Produktivbetrieb, als Infrastruktur skalieren kann. Teams benötigen eine breitere Modellauswahl, schnellere Datenpipelines und neue Funktionen für physische KI — ohne Kompromisse bei Sicherheit und Zuverlässigkeit. Die erweiterte Zusammenarbeit von AWS und NVIDIA schließt diese Lücke, indem beschleunigte Compute-Ressourcen, kundenspezifisches Silizium, Netzwerke und offene Modelle in gemeinsam entwickelten Stacks kombiniert werden, die als verwaltete Cloud-Services bereitstehen.

Was wurde angekündigt

Am 26. August 2026 haben Amazon Web Services und NVIDIA eine umfassende Erweiterung ihrer strategischen Zusammenarbeit bekannt gegeben. AWS plant, in den Jahren 2027-2028 2 Millionen zusätzliche NVIDIA GPUs in seiner globalen Infrastruktur bereitzustellen, darunter die Generationen Blackwell Ultra, Rubin und Rubin Ultra. Zudem wird Infrastruktur auf Basis von NVIDIA Vera CPUs auf AWS eingeführt, NVLink Fusion um kundenspezifischen High-Bandwidth-Memory (NVHBM) erweitert und KI-Fabriken für die US-Regierung errichtet — mit 100.000 GPUs auf sicherer AWS-Infrastruktur für Bundes- und nationale Sicherheits-Workloads auf Impact Level 6 (IL6) und höher.

Die Zusammenarbeit umfasst den gesamten Stack: GPUs, CPUs, Netzwerke, offene Modelle und Software. Die offenen NVIDIA Nemotron-Modelle sind auf Amazon Bedrock als serverlose Modelle und auf Amazon SageMaker für eigene Deployments verfügbar. Die Bibliotheken NVIDIA cuDF und cuVS CUDA-X beschleunigen die Datenverarbeitung auf Amazon EMR und die Vektorindexierung auf Amazon OpenSearch. Amazon Robotics setzt die physische KI-Plattform von NVIDIA — Jetson, Omniverse und Isaac — für Lagerautomatisierung und Roboter der nächsten Generation ein.

NVIDIA und AWS haben eine der zentralen Wachstumsmaschinen der KI-Ära geschaffen, und die Nachfrage übertrifft jede Prognose. Seit 16 Jahren skalieren wir gemeinsam NVIDIA-Computing in der Cloud. Nun erweitern wir unsere Partnerschaft über den gesamten Stack, um agentenbasierte und physische KI in einem beispiellosen Tempo Realität werden zu lassen.

Jensen Huang, Gründer und CEO von NVIDIA

Warum dies relevant ist

Für CIOs, CISOs und IT-Leiter bedeutet dies planbare Kapazität für Training und Inferenz — dort, wo bisher Ressourcenengpässe drohten. Einkaufsleiter erhalten eine breitere Auswahl: eigenes Silizium von AWS (Trainium), NVIDIA GPUs und Vera CPUs innerhalb einer einzigen Cloud, was die Abhängigkeit von einem einzelnen Anbieter innerhalb der Plattform reduziert. Das AWS Nitro System und der Elastic Fabric Adapter (EFA) bilden die Grundlage aller EC2-Instanzen mit NVIDIA GPU und Trainium und liefern die Isolation und Netzwerkleistung, die produktive KI-Workloads erfordern.

Für Behörden beseitigen dedizierte KI-Fabriken mit 100.000 GPUs auf IL6-zertifizierter Infrastruktur eine zentrale Hürde für den Einsatz generativer KI auf klassifizierten Workloads. Für Datenteams liefert die GPU-beschleunigte Verarbeitung auf Amazon EMR bis zu 3,7x schnellere Verarbeitung und 30 % besseres Preis-Leistungs-Verhältnis gegenüber CPU-Konfigurationen; die Vektorindexierung auf Amazon OpenSearch erreicht bis zu 9x schnellere Indexierung zu einem Viertel der Kosten.

Technische Details

  • GPU-Erweiterung: 2 Millionen zusätzliche NVIDIA Blackwell Ultra, Rubin und Rubin Ultra in 2027-2028 in der AWS-Infrastruktur und in KI-Fabriken.
  • Amazon EC2 G7: Ausgestattet mit NVIDIA RTX PRO 4500 Blackwell Server Edition — 4,6x KI-Inferenz und 2,1x Grafikleistung gegenüber G6.
  • NVIDIA Vera CPUs auf AWS: Hochleistungs-CPUs für die nächste Generation von KI-Workloads.
  • NVLink Fusion mit NVHBM: Kundenspezifischer Speicher integriert mit Trainium in gemeinsamer Rack-Scale-Architektur für höhere Effizienz.
  • KI-Fabriken für Bundesbehörden: 100.000 GPUs auf sicherer AWS-Infrastruktur für US-Regierungs-Workloads ab IL6.
  • Nitro System und EFA: Sicherheitsisolation und Low-Latency-Netzwerk für alle GPU- und Trainium-basierten EC2-Instanzen.
  • Offene Nemotron-Modelle: Verfügbar auf Amazon Bedrock (serverlos) und Amazon SageMaker.
  • Daten- und Vektorbeschleunigung: NVIDIA cuDF und cuVS CUDA-X auf Amazon EMR und Amazon OpenSearch für Analytics und RAG.
  • Physische KI: Amazon Robotics integriert NVIDIA Jetson, Omniverse und Isaac für Simulation, synthetische Datengenerierung und Robotertraining auf GPU-beschleunigten EC2.

Softprom und Amazon Web Services

Softprom ist der offizielle Partner von Amazon Web Services. Unser Team unterstützt Unternehmen, Behörden und Start-ups bei der Konzeption, Migration und Skalierung von Workloads auf AWS, einschließlich KI/ML-Plattformen auf Basis NVIDIA-beschleunigter Instanzen, Amazon Bedrock, Amazon SageMaker und Amazon EMR.

Dieser Inhalt wurde im Rahmen des Projekts Softprom DistriFlow erstellt — eines automatisierten Systems zur Überwachung und Anpassung von Vendor-News. Quelle: Originalartikel.