Huawei представила OceanStor M900 Context Memory Storage для масштабируемого кэша KV
Подробнее
Pandaily
pandaily.com

Huawei представила OceanStor M900 Context Memory Storage для масштабируемого кэша KV

Компания Huawei представила систему хранения данных OceanStor M900 Context Memory Storage на мероприятии HUAWEI CONNECT 2026, которое состоялось в Шанхае 17 сентября. Данное решение разработано как слой хранения, специально предназначенный для рабочих нагрузок AI inference SuperPoDs, а не как очередная дополнительная карта ускорителя.

В рамках презентации компания сосредоточилась на спецификациях продукта, касающихся инфраструктуры KV-кэша для искусственного интеллекта. При этом дорожные карты ускорителей Ascend SuperPoD и компоненты архитектуры Peerium, представленные в тот же период, не рассматривались.

По мере того как модели становятся триллионными по параметрам, а окна контекста превышают миллион токенов, рабочие нагрузки многоходовых агентов приводят к тому, что KV-кэш выходит за пределы встроенной памяти и DRAM. Ответ Huawei заключается в глобально объединенном многоуровневом KV-кэше, поддерживаемом UnifiedBus, который расширяет память SuperPoD с SRAM и DRAM на SSD.

Согласно материалам компании, один кластер способен достигать емкости в 64 петабайта. Это позволяет увеличить доступный KV-кэш на один NPU с уровня гигабайт до уровня терабайт для повторного использования, тем самым повышая частоту попаданий в кэш при инференсе с длинным контекстом.

Производительность системы основана на интегрированной архитектуре, объединяющей центральный процессор (CPU), сетевой контроллер и контроллер NAND. Благодаря этому NPU SuperPoD могут обращаться к SSD напрямую, минуя преобразование протокола или пересылку через CPU. Huawei утверждает, что этот путь сокращает задержку доступа с миллисекунд до примерно 60 микросекунд, что составляет заявленное снижение на 90%, и обеспечивает совокупную пропускную способность доступа около 40 ТБ/с, что на 1,5 раза выше, чем у конкурирующих решений.

В типичных сценариях программирования ИИ компания заявляет, что данная конструкция способна удвоить пропускную способность токенов кластера инференса и сократить время до первого токена (TTFT) вдвое; эти показатели остаются заявлениями вендора.

Вопросы ценообразования решаются за счет адаптивного хранения, чувствительного к KV, которое прогнозирует ценность жизненного цикла кэша и размещает данные в различных уровнях носителей. Huawei указывает на показатель до 24 операций записи диска в день (DWPD), что является заявленным увеличением долговечности SSD в 16 раз, а также на целевые показатели стабильности в течение трех лет, направленные на снижение затрат на замену носителей и стоимость токена для гипермасштабного инференса. Таким образом, OceanStor M900 представляет собой конкретный продукт Huawei, объединяющий вычисления, сеть и хранилище для общего контекстного кэша в масштабе петабайт, а не запуск чипа.

Похожие сюжеты

Huawei представила архитектуру Peerium с вложенным BSP для систем с миллионом процессоров
Подробнее
pandaily.com

Huawei представила архитектуру Peerium с вложенным BSP для систем с миллионом процессоров

Компания Huawei объявила о разработке вычислительной архитектуры Peerium. Эта система спроектирована таким образом, чтобы процессоры в масштабе примерно миллиона могли функционировать как единый компьютер благодаря использованию вложенного параллелизма, унифицированного адресования памяти и пиринговой межсоединительной шины.

Согласно пресс-релизу Huawei на английском языке от 17 сентября 2026 года, выпущенному из Шанхая, бренд этой технологии — Huawei / Peerium. Компания позиционирует Peerium как внедрение Nested BSP (Nested Bulk Synchronous Parallel), которое расширяет существующую архитектуру фон Неймана для одной машины, а не полностью отменяет десятилетние предположения о кластерах типа мастер-раб.

Это различие важно для читателей, сравнивающих Peerium с уже обсуждавшимися решениями Ascend SuperPoD и Lingqu interconnect. Ключевым элементом, который, по утверждению Huawei, обеспечивает работу Peerium, является UnifiedBus (UB).

UnifiedBus представляет собой единую высокоскоростную шину с открытым протоколом, предназначенную для масштабирования между ЦП, НПУ, памятью, SSD, сетевыми интерфейсами и коммутаторами. Это позволяет вычислительным, хранилищным и сетевым компонентам подключаться как равные участники.

Первые продукты, основанные на этой архитектуре, включают Atlas 950 SuperPoD и SuperClusters, построенные на базе SuperPoD. Huawei сообщила, что Atlas 950 SuperCluster с 256 000 картами уже находится в стадии развертывания, в то время как система Atlas 960, использующая почти упакованную оптику, проходит тестирование.

Председатель совета директоров Эрик Сюй связал развитие Peerium с продолжающимся производством SuperPoD и SuperCluster для удовлетворения потребностей в обучении и инференсе. Архитектура Peerium располагается на один уровень выше отдельных SKU Ascend, поскольку ее суть заключается в архитектурных особенностях: планировании Nested BSP, унифицированном адресовании и пиринговой фабрике UB. Это позволяет программировать большое количество карт более похоже на одну машину, нежели на иерархию мастеров и рабочих.

В сопроводительных документах к архитектуре не были представлены независимые тесты по задержке, пропускной способности и программному стеку; статус развертывания Atlas 950/960 остается информацией, предоставленной самой компанией.

Для покупателей инфраструктуры новость имеет значимость тем, что Huawei назвала Peerium вычислительной архитектурой, стоящей за SuperPoD в масштабе миллиона процессоров, используя Nested BSP и UnifiedBus в качестве технических опор, при этом четко подчеркнув, что она расширяет, а не отбрасывает дизайн одной машины фон Неймана.

Популярное