Huawei представила OceanStor M900 Context Memory Storage для масштабируемого кэша KV
Подробнее
Pandaily
pandaily.com

Huawei представила OceanStor M900 Context Memory Storage для масштабируемого кэша KV

Компания Huawei представила систему хранения данных OceanStor M900 Context Memory Storage на мероприятии HUAWEI CONNECT 2026, которое состоялось в Шанхае 17 сентября. Данное решение разработано как слой хранения, специально предназначенный для рабочих нагрузок AI inference SuperPoDs, а не как очередная дополнительная карта ускорителя.

В рамках презентации компания сосредоточилась на спецификациях продукта, касающихся инфраструктуры KV-кэша для искусственного интеллекта. При этом дорожные карты ускорителей Ascend SuperPoD и компоненты архитектуры Peerium, представленные в тот же период, не рассматривались.

По мере того как модели становятся триллионными по параметрам, а окна контекста превышают миллион токенов, рабочие нагрузки многоходовых агентов приводят к тому, что KV-кэш выходит за пределы встроенной памяти и DRAM. Ответ Huawei заключается в глобально объединенном многоуровневом KV-кэше, поддерживаемом UnifiedBus, который расширяет память SuperPoD с SRAM и DRAM на SSD.

Согласно материалам компании, один кластер способен достигать емкости в 64 петабайта. Это позволяет увеличить доступный KV-кэш на один NPU с уровня гигабайт до уровня терабайт для повторного использования, тем самым повышая частоту попаданий в кэш при инференсе с длинным контекстом.

Производительность системы основана на интегрированной архитектуре, объединяющей центральный процессор (CPU), сетевой контроллер и контроллер NAND. Благодаря этому NPU SuperPoD могут обращаться к SSD напрямую, минуя преобразование протокола или пересылку через CPU. Huawei утверждает, что этот путь сокращает задержку доступа с миллисекунд до примерно 60 микросекунд, что составляет заявленное снижение на 90%, и обеспечивает совокупную пропускную способность доступа около 40 ТБ/с, что на 1,5 раза выше, чем у конкурирующих решений.

В типичных сценариях программирования ИИ компания заявляет, что данная конструкция способна удвоить пропускную способность токенов кластера инференса и сократить время до первого токена (TTFT) вдвое; эти показатели остаются заявлениями вендора.

Вопросы ценообразования решаются за счет адаптивного хранения, чувствительного к KV, которое прогнозирует ценность жизненного цикла кэша и размещает данные в различных уровнях носителей. Huawei указывает на показатель до 24 операций записи диска в день (DWPD), что является заявленным увеличением долговечности SSD в 16 раз, а также на целевые показатели стабильности в течение трех лет, направленные на снижение затрат на замену носителей и стоимость токена для гипермасштабного инференса. Таким образом, OceanStor M900 представляет собой конкретный продукт Huawei, объединяющий вычисления, сеть и хранилище для общего контекстного кэша в масштабе петабайт, а не запуск чипа.

Похожие сюжеты

Huawei представила Ascend 960 SuperPoD с оптикой ближнего пакета на конференции Connect 2026
Подробнее
pandaily.com

Huawei представила Ascend 960 SuperPoD с оптикой ближнего пакета на конференции Connect 2026

На мероприятии Huawei Connect 2026, которое состоялось в Шанхае 17 сентября, председательствующий директор Дэвид Ванг представил Ascend 960 SuperPoD как суперузел следующего поколения для искусственного интеллекта. Акцент в разработке сделан на масштабируемости межсоединений, а не на производительности одного чипа.

Согласно описанию системы, Ascend 960 SuperPoD является первой моделью, использующей оптику ближнего пакета (NPO). Эта технология объединяет фабрику Lingqu UnifiedBus от Huawei с оптическим движком Hi-ONE, что позволяет размещать оптические соединения ближе к корпусу чипа.

По данным First Finance и сопутствующих отчетов, один Ascend 960 SuperPoD способен соединять около 4096 карт с задержкой туда-обратно, приближающейся к 2 микросекундам. Huawei утверждает, что такие показатели позволяют осуществлять крупномасштабное обучение и инференс моделей объемом до 10 триллионов параметров.

Кроме того, была озвучена более широкая информация о поставках: системы Ascend SuperPoD уже были отгружены более чем 1000 клиентам из более чем 370 компаний, что свидетельствует о переходе архитектуры из демонстрационных стендов в коммерческое использование.

Была скорректирована дорожная карта чипов. Huawei объявила, что Ascend 960DT планируется к выпуску в первом квартале 2027 года, а Ascend 960PR — в третьем квартале. Также запланирован выпуск жидкостного Atlas 960 SuperPoD в третьем квартале 2027 года, что на три квартала раньше первоначального публичного прогноза, который указывал на конец 2027 года для Ascend 960. Ванг также сообщил, что Huawei разработала 11 чипов на базе UnifiedBus для крупных систем и подтвердила долгосрочную цель создания SuperCluster на миллион карт.

Основной акцент делается на системной инженерии: это включает оптику NPO, UnifiedBus, системы охлаждения и программное обеспечение кластера, которые позволяют множеству карт Ascend функционировать как единая машина. Репортажи Reuters подтвердили двойные даты запуска в 2027 году и цифры поставок более 1000 суперузлов и более 370 клиентов, однако не назвали имена покупателей. Данная новость отличается от отчета Huawei об Интеллектуальном мире 2035, опубликованного накануне, поскольку здесь представлена конкретная информация о межсоединении SuperPoD и пересмотренном графике Atlas 960 для операторов, которые уже оценивают кластеры Ascend.

Популярное