Репортаж от Wedoany,На конференции WAIC 2026 китайская компания PPIO официально представила новую платформу Agentic Cloud и интеллектуальный шлюз моделей, предложив создать «интеллектуальную фабрику токенов» для эпохи агентов. Поскольку ожидается, что мировой рынок AI-агентов вырастет с 5,1 миллиарда долларов в 2024 году до 47,1 миллиарда долларов к 2030 году, спрос на токены для задач агентов резко возрастает.

Яо Синь, сооснователь и генеральный директор PPIO, отметил, что клиенты токенов переходят от людей к агентам, и облачным провайдерам необходимо предоставлять «фабрики токенов» с более низкой задержкой и более высокой пропускной способностью. Согласно данным CIC, хотя стоимость вывода снижается более чем в 10 раз ежегодно, количество токенов, потребляемых одной задачей агента, выросло с сотен на ранних этапах до десятков тысяч и даже сотен тысяч, что приводит к росту общего давления затрат. Кроме того, одна модель не может покрыть разнообразные потребности агентов, а требования агентов к задержке и стабильности значительно выше, чем у традиционных AI-приложений.
Ключевой продукт, выпущенный PPIO, — интеллектуальный шлюз моделей, использующий механизм «Смесь моделей» (Mixture of Models, MoM). На критических этапах работы агента шлюз распределяет задачу между несколькими экспертными моделями, генерируя ответы с помощью перекрестной проверки, чтобы избежать сбоев из-за узкой специализации модели. Шлюз также обладает возможностями интеллектуального планирования и оптимизации затрат, маршрутизируя задачи по типу и контролируя расходы с помощью механизмов сжатия избыточного контекста и бюджетных ограничений. Согласно тестам DRACO Deep Research, PPIO, объединив Mimo-V2.5-Pro, Kimi-K2.7 и GLM-5.2 для смешанного вывода, может повысить производительность до уровня, близкого к Claude Fable 5, увеличив интеллектуальный уровень на 20% и снизив затраты на 50-60%. Собственный движок ускорения вывода PPIO, оптимизированный для сценариев агентов, может повысить производительность вывода до 10 раз, а в сочетании с технологией Prompt Cache экономия затрат на токены может достигать 80%. PPIO был включен в первую партию «Базового уровня производительности корпоративных токенов» Китайской академии информационных и коммуникационных технологий, где в общих сценариях TPS ≥ 55/с, TTFT ≤ 0,9 с, а уровень успешности вызовов ≥ 99,9%.

В области среды выполнения агентов PPIO запустил песочницу агентов, основанную на технологии microVM, обеспечивающую холодный запуск за миллисекунды (<200 мс). Каждая задача выполняется в изолированной виртуальной среде, поддерживается одновременное создание десятков тысяч песочниц, а механизм Auto Pause/Resume позволяет снизить затраты до 90% по сравнению с аналогичными продуктами. С момента запуска на WAIC в прошлом году, эта первая в Китае песочница агентов, совместимая с интерфейсом E2B, увеличила масштаб бизнеса более чем в 123 раза. PPIO Agent Harness включает встроенные возможности Browser Use, Computer Use, Code Interpreter и MCP Server, охватывая полный цикл агента от получения информации до выполнения операций. Платформа предустанавливает несколько шаблонов агентов, таких как PPClaw и PPHermes, позволяя разработчикам развернуть их в облаке всего за 10 минут, а также поддерживает круглосуточное непрерывное обслуживание и планирование задач по расписанию.

Что касается данных, в июне 2026 года среднесуточный объем вызовов токенов PPIO превысил 1,2 триллиона, что ставит компанию на первое место среди независимых китайских облачных AI-провайдеров, с ростом более чем в 8 раз по сравнению с аналогичным периодом 2025 года. Выручка компании выросла с 358,4 миллиона юаней в 2023 году до 770,3 миллиона юаней в 2025 году, а количество зарегистрированных разработчиков по всему миру превысило 670 000. Средняя загрузка GPU PPIO в 2025 году постоянно превышала 75%, что значительно выше среднего показателя по отрасли в 40-50%. Яо Синь отметил, что PPIO, используя способность глобальной сети распределения «сглаживать пики и заполнять впадины» и используя разницу во времени между Восточным и Западным полушариями, доводит загрузку GPU до 70-80%. В настоящее время PPIO развернул распределенные мультикластеры в Европе, Северной Америке, Южной Америке, Юго-Восточной Азии и других регионах, охватывая 6 континентов мира.

Яо Синь заявил, что интеллектуальный предел существует не только внутри модели, но и за ее пределами — в инженерии агентов и слиянии моделей, что также может значительно повысить уровень интеллекта. PPIO стремится сделать токены дешевле, а работу агентов стабильнее, заранее закладывая базовую инфраструктуру для взрыва экономики агентов.

На основе уровня Harness платформа предустанавливает готовые к использованию шаблоны агентов, такие как PPClaw и PPHermes. Разработчики могут развернуть их в облаке одним нажатием через консоль, и они будут готовы к работе всего за 10 минут. После развертывания поддерживается круглосуточное непрерывное обслуживание и планирование задач по расписанию. Когда агент не используется, можно одним нажатием приостановить тарификацию, а при возобновлении работы он активируется за секунды. Платформа также предоставляет AI-нативные интерфейсы для агентов, поддерживающие стандартный протокол MCP, позволяя агентам вызывать такие ресурсы, как GPU-мощности и среды песочниц, с помощью естественного языка. Платформа совместима с основными фреймворками агентов, такими как LangChain, CrewAI и AutoGen.

Распределенная вычислительная сеть PPIO и высокоплотные вычислительные узлы обеспечивают базовую поддержку интеллектуальной фабрики токенов. Используя разницу в часовых поясах между регионами и разнообразные потребности клиентов, PPIO динамически распределяет глобальные простаивающие вычислительные мощности в точки пикового спроса, обеспечивая эффективное использование ресурсов GPU. Эта способность к планированию напрямую снижает фактическую стоимость единицы токена, становясь базовой гарантией модели «передний магазин, задняя фабрика» PPIO.










