Amazon Web Services (AWS) и Nvidia договорились дополнительно развернуть два миллиона графических процессоров в облачной инфраструктуре AWS в 2027–2028 годах.
Компании расширяют партнерство на фоне растущего спроса на вычисления для агентного и физического ИИ.
Новый план предполагает поставку более 2 млн GPU для глобальной инфраструктуры AWS в течение 2027 и 2028 годов. Это дополнение к предыдущим договоренностям: на GTC 2026 AWS объявила о планах установить более 1 млн GPU Nvidia начиная с 2026 года.
Таким образом, речь идет уже о многомиллионном парке ускорителей, который AWS намерена использовать для обучения и инференса моделей, а также новых типов нагрузок, связанных с автономными ИИ-агентами и роботами.
AWS интегрирует в свои ИИ-кластеры сразу несколько поколений платформ Nvidia — Blackwell Ultra, Rubin и Rubin Ultra. Параллельно компании расширяют сотрудничество в области кастомных чипов и памяти.
В частности, AWS готовит инфраструктуру на базе NVIDIA Vera CPU. Процессор разработан специально для задач, которые возникают вокруг ИИ-агентов: координации инструментов, выполнения кода, обработки данных и симуляций. Это должно дополнять GPU и позволять эффективнее использовать ускорители в многошаговых агентных сценариях.
Еще одно направление — интеграция технологий Nvidia с чипами AWS Trainium. Annapurna Labs, подразделение Amazon, и Nvidia расширяют ранее объявленную поддержку NVLink Fusion, включая использование высокоскоростной памяти Nvidia и масштабируемых межсоединений в конфигурациях уровня стоек.
AWS также представила EC2 G7 — облачные виртуальные серверы (инстансы) с GPU NVIDIA RTX PRO 4500 Blackwell Server Edition. Компания называет их первыми подобными предложениями среди крупных облачных провайдеров.
По данным Nvidia, G7 обеспечивают по сравнению с предыдущим поколением G6 повышение:
При этом GPU-инстансы и системы на базе Trainium продолжат использовать сетевую инфраструктуру AWS Nitro и Elastic Fabric Adapter вместе с сетевыми технологиями NVIDIA Spectrum.