AWS и NVIDIA планируют добавить 2 миллиона GPU в 2027–2028 годах

2026-08-28 11:28
В избр.

Репортаж от Wedoany,Amazon Web Services (AWS) и NVIDIA объявили о значительном расширении стратегического сотрудничества в ответ на растущий спрос на глобальную инфраструктуру искусственного интеллекта. Стороны планируют дополнительно развернуть 2 миллиона GPU NVIDIA в глобальной инфраструктуре AWS, а также углубить сотрудничество в таких направлениях, как AI-фабрики, CPU, сети, открытые модели, обработка данных и робототехника, чтобы предоставлять клиентам совместно разработанные AI-решения и ускорить разработку и внедрение ИИ.

Сейчас рабочие нагрузки ИИ переходят от этапа пилотных проектов к этапу производства, а сфера применения расширяется на агентный ИИ, научные открытия, автоматизацию предприятий и робототехнику. Клиентам требуется более широкий выбор моделей, более быстрые конвейеры обработки данных и возможности для новых сценариев использования, таких как физический ИИ, при этом базовая инфраструктура должна поддерживать темпы инноваций и обеспечивать высочайший уровень безопасности и надежности для критически важных рабочих нагрузок.

Основываясь на 16-летнем совместном опыте инноваций, AWS и NVIDIA расширят вычислительные мощности ИИ и будут быстрее внедрять новые совместно разработанные решения для клиентов. AWS предлагает самый широкий выбор GPU-инстансов среди всех облачных провайдеров. На конференции NVIDIA GTC 2026 года AWS объявила о планах добавить более 1 миллиона GPU NVIDIA начиная с 2026 года, после чего фактический спрос превысил эти ожидания. Теперь AWS планирует дополнительно развернуть 2 миллиона GPU NVIDIA Blackwell Ultra, Rubin и Rubin Ultra в глобальной инфраструктуре AWS (включая AI-фабрики) в 2027–2028 годах, охватывая такие клиентские рабочие нагрузки, как агентный ИИ, научные открытия, автоматизация предприятий и физический ИИ. Кроме того, AWS расширит емкость NVIDIA Blackwell, включая GPU NVIDIA RTX PRO 4500 Blackwell Server Edition для инстансов Amazon EC2 G7. Производительность инференса ИИ инстансов G7 в 4,6 раза выше, а графическая производительность в 2,1 раза выше, чем у предыдущего поколения инстансов G6. AWS — первый крупный облачный провайдер, предлагающий вычислительные инстансы, ускоряемые RTX PRO 4500. Кроме того, стороны сотрудничают в области сетей NVIDIA Spectrum, оптимизируя сетевую производительность между кластерами GPU для крупномасштабных обучающих рабочих нагрузок ИИ.

В области CPU-вычислений AWS и NVIDIA планируют внедрить инфраструктуру на основе NVIDIA Vera CPU в AWS, предоставляя дополнительные возможности для агентных ИИ-рабочих нагрузок, требующих взаимодействия высокопроизводительных CPU-вычислений и ускоренной инфраструктуры. Vera разработана для ИИ следующего поколения и дополняет стратегию AWS по широкому выбору вычислительных решений — от собственных чипов до новейших ускорителей и CPU партнеров.

В области межчипового соединения и памяти AWS на конференции re:Invent 2025 объявила о поддержке высокоскоростной технологии межчипового соединения NVIDIA NVLink Fusion в чипах Trainium следующего поколения. NVIDIA и Amazon Annapurna Labs расширяют эту поддержку, сотрудничая с производителями памяти для внедрения новой технологии NVIDIA Custom High Bandwidth Memory (NVHBM) в Trainium, что обеспечивает доступ к более быстрой и энергоэффективной памяти. В сочетании с NVLink Fusion Annapurna Labs может использовать технологию NVIDIA Custom Memory и архитектуру вертикального масштабирования для повышения производительности и эффективности ИИ-рабочих нагрузок, одновременно интегрируя Trainium и GPU в универсальную стоечную архитектуру.

Для государственных клиентов AWS и NVIDIA планируют построить AI-фабрики для правительства США, поставить программный стек NVIDIA AI и планируют предоставить 100 000 GPU в безопасной инфраструктуре AWS для федеральных рабочих нагрузок и рабочих нагрузок национальной безопасности. Это сотрудничество позволяет государственным учреждениям развертывать ИИ в больших масштабах для рабочих нагрузок уровня Impact Level 6 (IL6) и выше.

Расширенное сотрудничество основано на ряде уже реализованных технологических интеграций. Все инстансы Amazon EC2 на базе GPU NVIDIA и Trainium, включая инстансы с использованием NVLink Fusion, построены на AWS Nitro System и объединены через Elastic Fabric Adapter (EFA). Кроме того, GPU-ускоренные инстансы EC2 и инстансы на базе Trainium продолжат строиться на Nitro System и масштабироваться через EFA. Nitro и EFA совместно гарантируют, что по мере расширения AWS парка GPU NVIDIA и внедрения новых технологий межсоединений клиенты по-прежнему получают безопасность, надежность и сетевую производительность, необходимые для производственных ИИ-рабочих нагрузок. Что касается программной экосистемы, семейство открытых моделей NVIDIA Nemotron доступно на Amazon Bedrock в виде полностью управляемых бессерверных моделей, а также на Amazon SageMaker для самостоятельного развертывания и тонкой настройки клиентами.

Ускорение обработки данных — еще один реализованный результат сотрудничества. AWS и NVIDIA предоставляют GPU-ускоренную обработку данных на Amazon EMR с использованием инстансов Amazon EC2 G7 и библиотеки NVIDIA cuDF: скорость обработки до 3,7 раза выше по сравнению с конфигурациями на базе CPU, а соотношение цены и производительности улучшено на 30%. Для удовлетворения потребностей в крупномасштабных векторных базах данных, вызванных AI-приложениями, конвейерами RAG и семантическим поиском, GPU-ускоренные векторные индексы в Amazon OpenSearch Service переносят построение индексов на выделенные GPU, обеспечивая скорость векторного индексирования до 9 раз выше при стоимости всего в четверть от прежней — для управляемых кластеров и Amazon OpenSearch Serverless.

В области робототехники Amazon Robotics сотрудничает с NVIDIA, интегрируя полный стек платформы физического ИИ NVIDIA для разработки роботов следующего поколения. Платформа включает NVIDIA Jetson, библиотеки NVIDIA Omniverse и открытую платформу разработки роботов NVIDIA Isaac. Сотрудничество охватывает симуляцию, генерацию синтетических данных, обучение роботов, оптимизацию маршрутов, функциональную безопасность и проверку «реального-к-симуляции», все это работает на GPU-ускоренных инстансах Amazon EC2 для поддержки крупномасштабной симуляции, разнообразных обучающих данных и непрерывной проверки в реальном мире, необходимых для робототехнических рабочих нагрузок.

Эта новость является результатом компиляции и перепечатки информации из глобального Интернета и стратегических партнеров. Она предназначена только для читателей. Если у вас возникнут какие-либо нарушения или другие проблемы, пожалуйста, своевременно сообщите нам. Этот сайт изменить или удалить ее. Перепечатка этой статьи без официального разрешения строго запрещена.электронная почта:news@wedoany.com

Связанные продукты

Беспроводная локальная сеть | Точка доступа AirEngine 5776-56T - Huawei
WiFi-локальный переходник - CREATEC
Одномодовое волокно G.652B - SHENZHEN SDG INFORMATION CO., LTD.
Беспилотный рефрижератор Neolix X6 - Neolix Beijing Technology Co., Ltd.
Интеллектуальный автоматический калибратор давления ConST811A - Beijing ConST Instruments Technology Inc.
Контроллер системы обнаружения горючих газов 30 - Jinan Benan Technology Development Co., Ltd.
Автоматический патрульный робот/автоматический робот безопасности - FOTUN HONGKONG LIMITED
Интеллектуальная система мониторинга конвейерных лент - LUO YANG WIRE ROPE INSPECTION TECHNOLOGY CO., LTD.
Т профиль шкафа - Xinli Tongchuang Electronic Equipment Co., Ltd.
Тропосферный ветровой профилемер P-диапазона TWP16 - China Huayun Meteorological Technology Group Co., Ltd.
Планшетный портативный спутниковый терминал  Ручной портативный терминал с антенной диаметром 0,35 м - China Starwin Science & Technology co., Ltd.
Лазерный принтер TG1020AD - Xiamen Hanin Co., Ltd.
Читайте также
Renesas Electronics открывает лабораторию физического ИИ и робототехники в Пекине, Китай
2026-08-28
Vodafone Business и Tech Mahindra объединяют усилия для содействия ИИ-трансформации в Великобритании
2026-08-28
Новый режим ИИ от Google в США добавил отслеживание рейсов и бронирование отелей, охватив более 180 стран
2026-08-28
Американская OpenAI запустила ChatGPT Work с возможностью автоматического входа в аккаунты
2026-08-28
В Индонезии запущена AI-инфраструктура RAIA Grid протяжённостью 86 тысяч километров
2026-08-28
Немецкая группа Schwarz планирует инвестировать до 5,6 млрд евро в строительство центра обработки данных
2026-08-28
OpenAI с 26 августа восстанавливает 5-часовое ограничение для ChatGPT Plus
2026-08-27
Саудовская HUMAIN сотрудничает с Microsoft, чтобы представить арабскую AI-модель на своей платформе
2026-08-27
Американская Google планирует привлечь технологию Mechanize и команду за 1,5 млрд долларов
2026-08-27
NVIDIA представляет Jetson Orin Nano 2 с производительностью 78 TOPS, выход на рынок в первой половине 2027 года
2026-08-27