AWS и Nvidia: глобальная экспансия ИИ-инфраструктуры с двумя миллионами GPU
Amazon Web Services (AWS) и Nvidia заключили соглашение о развертывании дополнительных двух миллионов графических процессоров в облачной сети AWS в период с 2027 по 2028 год. Это расширение партнерства обусловлено растущим спросом на вычислительные мощности для агентного и физического искусственного интеллекта.
В рамках нового плана AWS планирует интегрировать более 2 млн GPU в свою глобальную сеть, что дополняет ранее заявленные планы по установке свыше 1 млн GPU Nvidia с 2026 года. Таким образом, компания создает многомиллионный парк ускорителей, предназначенных для обучения и инференса моделей, а также для поддержки автономных ИИ-агентов и роботов.
AWS намерена внедрить в ИИ-кластеры несколько поколений Nvidia платформ, включая Blackwell Ultra, Rubin и Rubin Ultra. Партнеры также работают над развитием кастомных чипов и памяти, включая готовящуюся инфраструктуру на базе процессоров NVIDIA Vera CPU, что позволит улучшить координацию и обработку данных для ИИ-агентов.
Кроме того, AWS и Nvidia расширяют интеграцию технологий, включая поддержку NVLink Fusion и использование высокоскоростной памяти Nvidia. AWS представила облачные серверы EC2 G7 с GPU NVIDIA RTX PRO 4500 Blackwell Server Edition, которые обеспечивают значительное повышение эффективности ИИ-инференса и графической производительности.
В рамках сотрудничества с государственными и оборонными структурами США, AWS и Nvidia создадут специализированные ИИ-фабрики, оснащенные 100 000 GPU Nvidia, способные обрабатывать секретные данные на уровне безопасности Impact Level 6 и выше.
Помимо облачной инфраструктуры, партнерство затрагивает и физическую сферу. Amazon Robotics будет использовать платформу Nvidia для физического ИИ, включая Jetson, Omniverse и Isaac, для автоматизации складов и моделирования поведения роботов. Открытые модели NVIDIA Nemotron останутся доступны через Amazon Bedrock и SageMaker для управляемых и кастомных развертываний.
В Nvidia подчеркнули, что сотрудничество с AWS отражает тенденцию в развитии ИИ-инфраструктуры, где акцент смещается с количества GPU на создание комплексных вычислительных фабрик, объединяющих ускорители, CPU, память и сети.