AWS и NVIDIA планируют добавить 2 миллиона GPU в 2027–2028 годах
Репортаж от Wedoany,Amazon Web Services (AWS) и NVIDIA объявили о значительном расширении стратегического сотрудничества в ответ на растущий спрос на глобальную инфраструктуру искусственного интеллекта. Стороны планируют дополнительно развернуть 2 миллиона GPU NVIDIA в глобальной инфраструктуре AWS, а также углубить сотрудничество в таких направлениях, как AI-фабрики, CPU, сети, открытые модели, обработка данных и робототехника, чтобы предоставлять клиентам совместно разработанные AI-решения и ускорить разработку и внедрение ИИ.

Сейчас рабочие нагрузки ИИ переходят от этапа пилотных проектов к этапу производства, а сфера применения расширяется на агентный ИИ, научные открытия, автоматизацию предприятий и робототехнику. Клиентам требуется более широкий выбор моделей, более быстрые конвейеры обработки данных и возможности для новых сценариев использования, таких как физический ИИ, при этом базовая инфраструктура должна поддерживать темпы инноваций и обеспечивать высочайший уровень безопасности и надежности для критически важных рабочих нагрузок.
Основываясь на 16-летнем совместном опыте инноваций, AWS и NVIDIA расширят вычислительные мощности ИИ и будут быстрее внедрять новые совместно разработанные решения для клиентов. AWS предлагает самый широкий выбор GPU-инстансов среди всех облачных провайдеров. На конференции NVIDIA GTC 2026 года AWS объявила о планах добавить более 1 миллиона GPU NVIDIA начиная с 2026 года, после чего фактический спрос превысил эти ожидания. Теперь AWS планирует дополнительно развернуть 2 миллиона GPU NVIDIA Blackwell Ultra, Rubin и Rubin Ultra в глобальной инфраструктуре AWS (включая AI-фабрики) в 2027–2028 годах, охватывая такие клиентские рабочие нагрузки, как агентный ИИ, научные открытия, автоматизация предприятий и физический ИИ. Кроме того, AWS расширит емкость NVIDIA Blackwell, включая GPU NVIDIA RTX PRO 4500 Blackwell Server Edition для инстансов Amazon EC2 G7. Производительность инференса ИИ инстансов G7 в 4,6 раза выше, а графическая производительность в 2,1 раза выше, чем у предыдущего поколения инстансов G6. AWS — первый крупный облачный провайдер, предлагающий вычислительные инстансы, ускоряемые RTX PRO 4500. Кроме того, стороны сотрудничают в области сетей NVIDIA Spectrum, оптимизируя сетевую производительность между кластерами GPU для крупномасштабных обучающих рабочих нагрузок ИИ.
В области CPU-вычислений AWS и NVIDIA планируют внедрить инфраструктуру на основе NVIDIA Vera CPU в AWS, предоставляя дополнительные возможности для агентных ИИ-рабочих нагрузок, требующих взаимодействия высокопроизводительных CPU-вычислений и ускоренной инфраструктуры. Vera разработана для ИИ следующего поколения и дополняет стратегию AWS по широкому выбору вычислительных решений — от собственных чипов до новейших ускорителей и CPU партнеров.
В области межчипового соединения и памяти AWS на конференции re:Invent 2025 объявила о поддержке высокоскоростной технологии межчипового соединения NVIDIA NVLink Fusion в чипах Trainium следующего поколения. NVIDIA и Amazon Annapurna Labs расширяют эту поддержку, сотрудничая с производителями памяти для внедрения новой технологии NVIDIA Custom High Bandwidth Memory (NVHBM) в Trainium, что обеспечивает доступ к более быстрой и энергоэффективной памяти. В сочетании с NVLink Fusion Annapurna Labs может использовать технологию NVIDIA Custom Memory и архитектуру вертикального масштабирования для повышения производительности и эффективности ИИ-рабочих нагрузок, одновременно интегрируя Trainium и GPU в универсальную стоечную архитектуру.
Для государственных клиентов AWS и NVIDIA планируют построить AI-фабрики для правительства США, поставить программный стек NVIDIA AI и планируют предоставить 100 000 GPU в безопасной инфраструктуре AWS для федеральных рабочих нагрузок и рабочих нагрузок национальной безопасности. Это сотрудничество позволяет государственным учреждениям развертывать ИИ в больших масштабах для рабочих нагрузок уровня Impact Level 6 (IL6) и выше.
Расширенное сотрудничество основано на ряде уже реализованных технологических интеграций. Все инстансы Amazon EC2 на базе GPU NVIDIA и Trainium, включая инстансы с использованием NVLink Fusion, построены на AWS Nitro System и объединены через Elastic Fabric Adapter (EFA). Кроме того, GPU-ускоренные инстансы EC2 и инстансы на базе Trainium продолжат строиться на Nitro System и масштабироваться через EFA. Nitro и EFA совместно гарантируют, что по мере расширения AWS парка GPU NVIDIA и внедрения новых технологий межсоединений клиенты по-прежнему получают безопасность, надежность и сетевую производительность, необходимые для производственных ИИ-рабочих нагрузок. Что касается программной экосистемы, семейство открытых моделей NVIDIA Nemotron доступно на Amazon Bedrock в виде полностью управляемых бессерверных моделей, а также на Amazon SageMaker для самостоятельного развертывания и тонкой настройки клиентами.
Ускорение обработки данных — еще один реализованный результат сотрудничества. AWS и NVIDIA предоставляют GPU-ускоренную обработку данных на Amazon EMR с использованием инстансов Amazon EC2 G7 и библиотеки NVIDIA cuDF: скорость обработки до 3,7 раза выше по сравнению с конфигурациями на базе CPU, а соотношение цены и производительности улучшено на 30%. Для удовлетворения потребностей в крупномасштабных векторных базах данных, вызванных AI-приложениями, конвейерами RAG и семантическим поиском, GPU-ускоренные векторные индексы в Amazon OpenSearch Service переносят построение индексов на выделенные GPU, обеспечивая скорость векторного индексирования до 9 раз выше при стоимости всего в четверть от прежней — для управляемых кластеров и Amazon OpenSearch Serverless.
В области робототехники Amazon Robotics сотрудничает с NVIDIA, интегрируя полный стек платформы физического ИИ NVIDIA для разработки роботов следующего поколения. Платформа включает NVIDIA Jetson, библиотеки NVIDIA Omniverse и открытую платформу разработки роботов NVIDIA Isaac. Сотрудничество охватывает симуляцию, генерацию синтетических данных, обучение роботов, оптимизацию маршрутов, функциональную безопасность и проверку «реального-к-симуляции», все это работает на GPU-ускоренных инстансах Amazon EC2 для поддержки крупномасштабной симуляции, разнообразных обучающих данных и непрерывной проверки в реальном мире, необходимых для робототехнических рабочих нагрузок.
Связанные продукты





Интеллектуальный автоматический калибратор давления ConST811A
Beijing ConST Instruments Technology Inc.
Контроллер системы обнаружения горючих газов 30
Jinan Benan Technology Development Co., Ltd.
Автоматический патрульный робот/автоматический робот безопасности
FOTUN HONGKONG LIMITED
Интеллектуальная система мониторинга конвейерных лент
LUO YANG WIRE ROPE INSPECTION TECHNOLOGY CO., LTD.

Тропосферный ветровой профилемер P-диапазона TWP16
China Huayun Meteorological Technology Group Co., Ltd.
Планшетный портативный спутниковый терминал Ручной портативный терминал с антенной диаметром 0,35 м
China Starwin Science & Technology co., Ltd.









