Плотность агентов NVIDIA Blackwell может в 20 раз превышать показатели Hopper
2026-06-15 15:37
В избр.

Репортаж от Wedoany,Компания Artificial Analysis представила первый в отрасли эталонный тест для автономного ИИ — AgentPerf, предоставив разработчикам, предприятиям и поставщикам инфраструктуры стандартный метод сравнения автономных систем ИИ. Результаты первого раунда тестирования показали, что платформа NVIDIA Blackwell Ultra NVL72 демонстрирует лидирующую производительность в рабочих нагрузках автономного ИИ, поддерживая в 20 раз больше агентов на мегаватт по сравнению с системами NVIDIA Hopper.

Рабочие нагрузки автономного ИИ принципиально отличаются от диалогового ИИ. Один чат-сеанс подобен спринту: требуется лишь один вызов большой языковой модели (LLM) и один ответ. Агент же больше напоминает эстафету: он разбивает цель на множество шагов и продолжает работу до завершения задачи.

Такой режим приводит к десяткам или сотням последовательных вызовов LLM, где каждый вызов передаёт растущий контекст следующему, а при каждой передаче выполняются вызовы инструментов: компиляция и выполнение кода, поиск в базах данных, просмотр веб-страниц. Сложность здесь не суммируется, а умножается.

Это различие критически важно для оценки производительности. Существующие эталонные тесты вывода ИИ измеряют одиночные вызовы LLM — скорость ответа модели на отдельный запрос и количество запросов, которые система может обрабатывать одновременно. Они не предназначены для автономных рабочих нагрузок, поскольку цепочки вызовов LLM, задержки вызова инструментов и растущий контекст создают на ускорительные вычислительные системы нагрузку, принципиально отличную от одиночного вызова LLM.

Для компаний, которые массово создают и развёртывают агентов, критически важно понимать скорость ответа агентов, количество одновременно развёртываемых агентов, а также объём полезной работы, выполняемой на каждый доллар и каждый ватт электроэнергии, вложенные в инфраструктуру ИИ.

В первом раунде тестирования AgentPerf использовал DeepSeek V4 Pro — большую гибридную экспертную модель, представляющую современный класс передовых моделей, управляющих наиболее мощными агентами, — для измерения автономной производительности. В этой рабочей нагрузке NVIDIA GB300 NVL72 показала наивысшую производительность в тесте, поддерживая в 20 раз больше агентов на мегаватт, чем система NVIDIA HGX H200.

Это преимущество в производительности обусловлено экстремальным синергетическим дизайном полного стека. GB300 NVL72 объединяет 72 графических процессора в единую стоечную систему, что позволяет эффективно распределять выполнение больших MoE-моделей, таких как DeepSeek V4 Pro, в масштабе. Ядра CUDA дополнительно ускоряют работу за счёт перекрытия коммуникаций и вычислений, поэтому затраты на координацию между экспертами поглощаются, а не увеличивают задержку. По мере роста масштаба параллельных сессий агентов NVIDIA TensorRT LLM сохраняет эффективность, разделяя обработку входных данных и генерацию выходных, что позволяет независимо оптимизировать каждый этап. Эти результаты основаны на методологии тестирования, созданной с нуля для отражения реальной работы автономного ИИ в производственной среде.

AgentPerf построен на основе трасс реальных агентов по написанию кода. Агент получает задачу, читает файлы, пишет и редактирует код, выполняет команды и итеративно обрабатывает результаты — все данные взяты из реальных публичных репозиториев кода на более чем 12 языках программирования. Длинные последовательности, шаблоны вызовов инструментов и задержки отражают реальные рабочие процессы кодирования. AgentPerf измеряет, сколько таких автономных задач платформа может поддерживать одновременно, соблюдая установленные пороги производительности, такие как время отклика и скорость вывода токенов. Вызовы инструментов не выполняются фактически, а моделируются с использованием репрезентативного времени обработки ЦП, поэтому различия в результатах отражают только влияние производительности ускорительных вычислений. Результаты напрямую конвертируются в решения по инфраструктуре: количество параллельных автономных задач на один ускоритель и на мегаватт электроэнергии.

Ведущие провайдеры вывода, включая Baseten, DeepInfra и Together AI, уже обслуживают автономные рабочие нагрузки на передовых моделях, таких как DeepSeek V4 Pro, на платформе NVIDIA Blackwell. Together AI обеспечивает вывод в реальном времени для Cursor — автономной платформы кодирования на базе ИИ — на NVIDIA Blackwell. Агенты Cursor отлаживают проблемы, генерируют функции и выполняют рефакторинг, пока разработчик продолжает работу. DeepInfra поддерживает Pam.ai — платформу ИИ-работников для автомобильных дилеров, которая полностью развёртывает агентов на NVIDIA Blackwell для бронирования сервисных встреч, обработки звонков и проведения исходящих продаж. По мере того как NVIDIA и экосистема с открытым исходным кодом продолжают оптимизировать программное обеспечение для вывода, производительность и эффективность автономных рабочих нагрузок будут расти. Архитектура NVIDIA Vera Rubin уже запущена в полномасштабное производство, что обеспечит следующее поколение инфраструктурных мощностей для удовлетворения растущего спроса на масштабируемый автономный ИИ. Подробнее о методологии AgentPerf и оптимизации полного стека можно узнать в соответствующем техническом блоге.

Данный материал скомпилирован платформой Wedoany. При цитировании материалов, созданных с помощью искусственного интеллекта (ИИ), необходимо обязательно указывать источник — «Wedoany». В случае выявления нарушения прав или иных проблем просим своевременно информировать нас. Сайт оперативно внесёт изменения или удалит материал.Электронная почта: news@wedoany.com

Эта новость является результатом компиляции и перепечатки информации из глобального Интернета и стратегических партнеров. Она предназначена только для читателей. Если у вас возникнут какие-либо нарушения или другие проблемы, пожалуйста, своевременно сообщите нам. Этот сайт изменить или удалить ее. Перепечатка этой статьи без официального разрешения строго запрещена.электронная почта:news@wedoany.com
Связанные продукты
Последние новости
1
Турция добавила 2,1 ГВт солнечной энергии в первом полугодии 2026 года
2
Первый этап индонезийского проекта солнечной энергетики мощностью 100 ГВт одобрен, скоро закладка первого камня
3
Clariant расширяет дистрибуцию добавок для нефтепромысловых работ в трех странах Западной Африки в партнерстве с Gapuma
4
Braskem и Lallemand запускают платформу по производству биологического ацетона в США
5
Продажи Wacker Chemie во 2-м квартале 2026 года составили 1,52 млрд евро, рост на 7% в годовом исчислении
6
INEOS планирует запустить крекинг-установку по переработке этана стоимостью 5 млрд евро в Бельгии в 2027 году
7
Grundfos Великобритания: сельское хозяйство потребляет 70% мировых запасов пресной воды, необходимо повышать устойчивость водных ресурсов
8
Фермеры Иллинойса расширяют посевные площади озимой пшеницы до 300 акров
9
ADM планирует расширить мощности по переработке масличных культур в США примерно на 700 тысяч тонн
10
Американская компания Star of the West получила 450 тысяч долларов на строительство кукурузной мельницы
Связанные рекомендации
Индийская HFCL получила заказ на оптоволоконные кабели на сумму 46,13 млн долларов США с поставкой до 2027 года
2026-07-31
Министерство энергетики США и альянс инвестируют 100 миллиардов долларов в строительство центров обработки данных и энергетической инфраструктуры
2026-07-31
Silvaco и NVIDIA объединяют усилия для продвижения цифровых двойников в полупроводниковой отрасли
2026-07-31
Google обновляет Gemini для macOS, добавляя системную голосовую диктовку и восприятие экрана
2026-07-31
Версия 1.131 Visual Studio Code от Microsoft добавила функции диктовки и субагентов
2026-07-31
Corning из США нацеливается на рынок CPO объемом 10 миллиардов долларов
2026-07-31
Канадская TELUS планирует развернуть 100% Open RAN к 2029 году
2026-07-31
Акции Oracle взлетели более чем на 8%! Расширение сотрудничества с Google Cloud: модели Gemini будут полностью интегрированы в корпоративные приложения Fusion и NetSuite
2026-07-31
Новый шаг ByteDance! Doubao, Feishu и Volcano Engine будут реорганизованы и объединены
2026-07-30
Intel открывает технологию процессоров Atom для стартапа Rosaic Labs
2026-07-30