Meta реструктурирует хранилище: время перемещения данных между регионами сокращено на 97%

2026-07-07 09:20
В избр.

Репортаж от Wedoany,Компания Meta недавно раскрыла детальную архитектуру своего хранилища инфраструктуры, заявив, что её система позволяет исследователям сократить время перемещения данных для обучения ИИ между регионами до 97%. Технологический гигант развивает облачное подразделение и может войти в число крупнейших игроков. В официальном заявлении Meta отмечается, что производительность графических процессоров удваивается примерно каждые два года, но скорость хранения данных не поспевает за этим темпом. Чтобы устранить разрыв и обслуживать кластеры хранения, необходимые для Meta AI, Reality Labs, социальных платформ и будущих облачных клиентов, инженеры перестроили уровень BLOB-хранилища, расположенный поверх многопользовательской структуры хранения Tectonic, охватывающей дата-центры по всему миру и измеряемой эксабайтами.

Традиционная архитектура BLOB от Meta была неэффективна с точки зрения ресурсов при поддержке обучения ИИ. Инженеры-программисты Сидхартх Баджадж и Венкатрагхаван Шринивасан отметили, что старая система содержала избыточное количество сервисных уровней и требовала последовательного поиска метаданных с сохранением состояния на нескольких уровнях, прежде чем можно было сопоставить путь к файлу с фактическим местом хранения, что увеличивало задержки и снижало производительность. Перестроенное хранилище основано на трёх ключевых изменениях: во-первых, разрозненные системы метаданных объединены в единую модель, поддерживаемую базой данных ZippyDB, что обеспечивает практически мгновенный поиск пути; во-вторых, устранён «прокси-уровень данных» и внедрена «толстая клиентская» архитектура, передающая байтовые потоки напрямую от серверов хранения к клиентам, снижая задержки и повышая энергоэффективность; в-третьих, переход от глобальной модели развёртывания к региональной, размещающей хранилище в одном месте с необходимыми GPU.

Помимо полного улучшения общего стека хранения, инженеры Meta использовали свободную память GPU в качестве распределённого кэша для часто одновременно запрашиваемых данных. Команда применила опыт системы Owl, используемой для распределения больших объектов данных, интегрировав её логику однорангового обмена в SDK клиента BLOB-хранилища. Все запросы данных проходят через этот кэш, что снижает частоту обращений GPU к хранилищу. Кроме того, Meta внедрила независимый кэш метаданных «плана чтения», возвращающий адреса часто запрашиваемых файлов за одну-две миллисекунды. Такая комбинация поглощает пики нагрузки, например, когда GPU одновременно перезагружаются и запрашивают одни и те же «горячие» веса моделей, одновременно улучшая задержки.

Финальная версия также устранила проблемы перегрузки и тайм-аутов, вызванные пиками экспорта. Meta реализовала программное решение динамического управления параллелизмом, которое регулирует степень параллелизма на основе сигналов перегрузки на уровне приложения, автоматически уменьшая количество запросов, отправляемых приложением при высоком трафике. По словам Баджаджа и Шринивасана, переработанный стек BLOB-хранилища теперь поддерживает рабочие нагрузки ИИ без простоев GPU, экономя средства и обеспечивая преимущества в производительности.

Для решения проблем доставки данных инженеры создали иерархическую систему кэширования, имитирующую способ, которым CPU компьютера извлекает данные с диска в более быстрые уровни памяти. Память и флеш-накопители на хосте GPU служат самым быстрым уровнем, региональное флеш-хранилище BLOB — следующим, а глобальное хранилище BLOB на HDD — окончательным источником истины. Новая парадигма загрузки данных уже применяется в производственных рабочих нагрузках: среднее время приёма сократилось со 150 минут до 10 минут, то есть на 93%. В максимальном случае Meta наблюдала сокращение времени приёма с 89 часов до 182 минут, то есть на 97%. Meta заявила: «Современные рабочие нагрузки ИИ требуют больших объёмов данных, и узкие места в хранилище напрямую влияют на загрузку GPU и стоимость вычислений. Перестроив подсистему метаданных и внедрив иерархическую архитектуру кэширования с предварительной выборкой/гидратацией по запросу, мы смогли эффективно удовлетворить потребности сегодняшних рабочих нагрузок».

Эта новость является результатом компиляции и перепечатки информации из глобального Интернета и стратегических партнеров. Она предназначена только для читателей. Если у вас возникнут какие-либо нарушения или другие проблемы, пожалуйста, своевременно сообщите нам. Этот сайт изменить или удалить ее. Перепечатка этой статьи без официального разрешения строго запрещена.электронная почта:news@wedoany.com

Связанные продукты

Интеллектуальная система мониторинга конвейерных лент - LUO YANG WIRE ROPE INSPECTION TECHNOLOGY CO., LTD.
Решения для систем безопасности SIS - Beijing Consen Automation Technology Co., Ltd.
Лазерный принтер TG1020AD - Xiamen Hanin Co., Ltd.
Беспилотный рефрижератор Neolix X6 - Neolix Beijing Technology Co., Ltd.
Антенные системы и сопутствующая электронная продукция - Chengdu Zhongdian Jinjiang Information Industry Co., Ltd.
QPS-20A Резервированный переключатель питания - CHN ENERGY ZHISHEN CONTROL TECHNOLOGY CO., LTD.
Тропосферный ветровой профилемер P-диапазона TWP16 - China Huayun Meteorological Technology Group Co., Ltd.
Т профиль шкафа - Xinli Tongchuang Electronic Equipment Co., Ltd.
Промышленная кольцевая сеть Ethernet для горнодобывающей промышленности (10 Гбит/с / 1 Гбит/с) - Chongqing Mas Sci&Tech Co., Ltd.
Планшетный портативный спутниковый терминал  Ручной портативный терминал с антенной диаметром 0,35 м - China Starwin Science & Technology co., Ltd.
Контроллер системы обнаружения горючих газов 30 - Jinan Benan Technology Development Co., Ltd.
Решение для защиты офиса от утечки данных - Sangfor Technologies Inc.
Читайте также
Siemens в 2026 году в Австралии заявляет, что ИИ меняет инфраструктуру центров обработки данных
2026-09-03
Bull получила контракт на суперкомпьютер LUMI-AI на сумму 387,8 млн евро
2026-09-02
Южнокорейский SK Telecom создает новую дочернюю компанию для AI-центров обработки данных, привлекая финансирование в размере 2,2 млрд долларов США
2026-08-29
Amazon Web Services приобретает нидерландского разработчика DuckDB — компанию DuckLabs
2026-08-28
Vodafone Business и Tech Mahindra объединяют усилия для содействия ИИ-трансформации в Великобритании
2026-08-28
Немецкая группа Schwarz планирует инвестировать до 5,6 млрд евро в строительство центра обработки данных мощностью 240 МВт
2026-08-28
Новый режим ИИ от Google в США добавил отслеживание рейсов и бронирование отелей, охватив более 180 стран
2026-08-28
AWS и NVIDIA планируют добавить 2 миллиона GPU в 2027–2028 годах
2026-08-28
Parkin и Amakin из Бахрейна подписали меморандум о сотрудничестве в сфере интеллектуальных парковочных услуг
2026-08-27
В августе 2026 года компания LeanDNA из США представила моделирование сценариев спроса в APEX
2026-08-26