Репортаж от Wedoany,Китайская компания Lynxi Technology в рамках WAIC представила собственный кластер нейроморфных суперузлов LynAInfra (灵琍). Данный продукт обеспечивает почти 100 PFlops производительности при энергопотреблении 30 кВт, нацелен на решение двух ключевых проблем в сфере AI-инференса — высокое энергопотребление и задержки.

В настоящее время масштабное внедрение AI-инференса сталкивается с двойным ограничением: чрезмерно высоким энергопотреблением и значительными задержками. Даже при постоянном обновлении GPU-продуктов фундаментальные ограничения традиционной чиповой архитектуры остаются непреодоленными. В то же время рыночные требования к задержкам инференса и стоимости использования постоянно растут, особенно в таких высокоценных сценариях, как ускорение AI-программирования, генерация AI-видео и многолетнее взаимодействие. Развертывание Groq компанией NVIDIA для ускорения высокоскоростного инференса также подтверждает, что отрасль остро нуждается в инновационных решениях для архитектуры инференса. Опираясь на характеристики собственных нейроморфных чипов — объединение памяти и вычислений, событийно-управляемая архитектура, многопоточный параллелизм, — Lynxi Technology выпустила высокопроизводительный нейроморфный суперузел LynAInfra для сценариев высокоскоростного инференса. Его энергоэффективность при инференсе в 3–10 раз выше по сравнению с традиционными GPU-решениями, а задержка первого токена сокращена до десятков–сотен миллисекунд.

Кластер суперузлов LynAInfra построен на основе нейроморфных чипов, уже прошедших масштабное коммерческое внедрение в Китае. Вычислительный шкаф LynAInfra128 оснащен 128 платами серии HP640, в одном шкафу каскадно объединены тысячи нейроморфных чипов, обеспечивающих производительность почти 100 PFlops@FP16 при энергопотреблении всего до 30 кВт. Продукт использует собственный протокол высокоскоростного межсоединения LynxLink и технологию компиляции с единым адресным пространством памяти, поддерживает масштабирование производительности в рамках одного шкафа (Scale up) и горизонтальное расширение на несколько шкафов (Scale out). Оборудование использует воздушное охлаждение и модульную конструкцию, совместимо с существующими стойками, системами электропитания и сетями в центрах обработки данных, что снижает затраты клиентов на развертывание и модернизацию.

LynAInfra реализует полную инновационную цепочку от архитектуры чипа до межкластерного соединения, позволяя бесшовно каскадировать несколько шкафов для выполнения задач инференса сверхбольших моделей. Благодаря архитектурной энергоэффективности продукт обеспечивает почти 100 PFlops производительности при энергопотреблении 30 кВт, что способствует снижению выбросов углерода при использовании вычислительных мощностей и соответствует китайской стратегии «двойного углерода». Для корпоративных клиентов это позволяет снизить удельные затраты на вычисления при инференсе больших моделей, способствуя внедрению больших моделей в таких сценариях, как цифровизация промышленности, городское управление и передовые научные исследования. Вся система придерживается пути независимых отечественных инноваций, направленных на укрепление безопасности китайской цепочки поставок вычислительных мощностей.










