AWS та NVIDIA: 2 мільйони додаткових GPU для агентного та фізичного AI у 2027-2028
News | 01.09.2026
AWS і NVIDIA розширюють 16-річне партнерство, щоб відповісти на стрімке зростання попиту на інфраструктуру для агентного та фізичного AI.
Підприємства, дослідницькі лабораторії та державні установи переводять AI-навантаження з пілотів у промислову експлуатацію швидше, ніж інфраструктура встигає масштабуватися. Командам потрібен ширший вибір моделей, швидші конвеєри даних і нові можливості для фізичного AI без компромісів у безпеці та надійності. Розширена співпраця AWS і NVIDIA закриває цей розрив: прискорені обчислення, кастомний кремній, мережі та відкриті моделі поєднуються у спільно розроблених стеках, доступних як керовані хмарні сервіси.
Що було анонсовано
26 серпня 2026 року Amazon Web Services і NVIDIA оголосили про суттєве розширення стратегічної співпраці. AWS планує розгорнути 2 мільйони додаткових NVIDIA GPU у глобальній інфраструктурі протягом 2027-2028 років, включно з поколіннями Blackwell Ultra, Rubin і Rubin Ultra. Компанії також виведуть на AWS інфраструктуру на базі NVIDIA Vera CPU, розширять NVLink Fusion за рахунок кастомної пам'яті NVHBM і побудують AI-фабрики для уряду США — 100 000 GPU на захищеній інфраструктурі AWS для федеральних і оборонних навантажень рівня Impact Level 6 (IL6) і вище.
Співпраця охоплює повний стек: GPU, CPU, мережі, відкриті моделі та ПЗ. Відкриті моделі NVIDIA Nemotron доступні на Amazon Bedrock у безсерверному режимі та на Amazon SageMaker для власного розгортання. Бібліотеки NVIDIA cuDF і cuVS CUDA-X прискорюють обробку даних на Amazon EMR та векторну індексацію на Amazon OpenSearch. Amazon Robotics впроваджує платформу фізичного AI від NVIDIA — Jetson, Omniverse та Isaac — для автоматизації складів і роботів нового покоління.
NVIDIA та AWS створили один із головних двигунів зростання епохи AI, і попит випереджає будь-які прогнози. 16 років ми разом масштабуємо обчислення NVIDIA у хмарі. Тепер ми розширюємо партнерство на повний стек, щоб зробити агентний і фізичний AI реальністю у безпрецедентному темпі та масштабі, який можуть забезпечити лише AWS і NVIDIA.
Чому це важливо
Для CIO, CISO та ІТ-директорів це означає прогнозовану ємність для навчання та інференсу — там, де раніше виникали обмеження з розподілу ресурсів. Керівники з закупівель отримують ширший вибір обчислень: власний кремній AWS (Trainium), GPU NVIDIA та Vera CPU в межах однієї хмари, що знижує залежність від одного постачальника всередині платформи. AWS Nitro System та Elastic Fabric Adapter (EFA) лежать в основі всіх EC2-інстансів на NVIDIA GPU та Trainium, забезпечуючи ізоляцію і мережеву продуктивність для промислового AI.
Для державних агенцій виділені AI-фабрики зі 100 000 GPU на інфраструктурі, сертифікованій за IL6, знімають ключовий бар'єр для розгортання генеративного AI на класифікованих навантаженнях. Для команд роботи з даними GPU-прискорена обробка на Amazon EMR дає до 3,7x швидшу обробку та на 30% кращу ціну-продуктивність порівняно з CPU, а векторна індексація на Amazon OpenSearch — до 9x швидшу індексацію за чверть вартості.
Технічні деталі
- Розширення GPU: 2 мільйони додаткових NVIDIA Blackwell Ultra, Rubin і Rubin Ultra у 2027-2028 роках у глобальній інфраструктурі AWS та AI-фабриках.
- Amazon EC2 G7: на базі NVIDIA RTX PRO 4500 Blackwell Server Edition — 4,6x швидший AI-інференс і 2,1x краща графіка порівняно з G6.
- NVIDIA Vera CPU на AWS: високопродуктивні процесори для наступного покоління AI-навантажень.
- NVLink Fusion з NVHBM: кастомна пам'ять інтегрована з Trainium у спільній rack-scale архітектурі для вищої ефективності.
- Федеральні AI-фабрики: 100 000 GPU на захищеній інфраструктурі AWS для навантажень уряду США рівня IL6 і вище.
- Nitro System і EFA: ізоляція безпеки та мережа з низькою затримкою для всіх EC2-інстансів на GPU та Trainium.
- Відкриті моделі Nemotron: доступні на Amazon Bedrock (serverless) та Amazon SageMaker.
- Прискорення даних і векторів: бібліотеки NVIDIA cuDF і cuVS CUDA-X на Amazon EMR та Amazon OpenSearch для аналітики і RAG.
- Фізичний AI: Amazon Robotics інтегрує NVIDIA Jetson, Omniverse та Isaac для симуляції, генерації синтетичних даних і навчання роботів на GPU-прискорених EC2.
Softprom та Amazon Web Services
Softprom є офіційним партнером Amazon Web Services. Наша команда допомагає підприємствам, державним організаціям і стартапам проєктувати, мігрувати та масштабувати навантаження в AWS, зокрема AI/ML-платформи на базі NVIDIA-прискорених інстансів, Amazon Bedrock, Amazon SageMaker та Amazon EMR.
Замовте консультацію та оцініть варіанти NVIDIA-прискорених обчислень для вашої AI-стратегії разом із Amazon Web Services.
Цей матеріал підготовлено в рамках проєкту Softprom DistriFlow — автоматизованої системи моніторингу та адаптації новин вендорів. Джерело: оригінальна стаття.