Huawei, Alibaba и поставщики AI-инфраструктуры Китая представили систему суперузлов на WAIC 2026
Всемирная конференция по искусственному интеллекту 2026 года и Совещание высокого уровня по глобальному управлению ИИ прошли в Шанхае с 17 по 20 июля под девизом «Умные партнеры, создающие будущее». В мероприятии приняли участие представители более чем 100 стран и международных организаций, а также представители правительства, академических кругов, исследовательских институтов и промышленности. В ходе конференции Государственный комитет по развитию и реформам КНР опубликовал «План действий по сотрудничеству в области развития искусственного интеллекта». План определяет восемь направлений сотрудничества, включая высококачественное обеспечение данными, общедоступные интеллектуальные вычислительные сервисы, обмен открытой экосистемой, промышленное внедрение, подготовку кадров, разработку стандартов, безопасное управление и ответственный ИИ. Вычислительная инфраструктура остается одной из ключевых тем конференции. В отличие от прошлогодних запусков, сосредоточенных на отдельных чипах-ускор

Huawei, Alibaba и поставщики AI-инфраструктуры Китая представили систему суперузлов на WAIC 2026
Введение
Всемирная конференция по искусственному интеллекту 2026 года и Совещание высокого уровня по глобальному управлению ИИ прошли в Шанхае с 17 по 20 июля под девизом «Умные партнеры, создающие будущее». В мероприятии приняли участие представители более чем 100 стран и международных организаций, а также представители правительства, академических кругов, исследовательских институтов и промышленности.
В ходе конференции Государственный комитет по развитию и реформам КНР опубликовал «План действий по сотрудничеству в области развития искусственного интеллекта». План определяет восемь направлений сотрудничества, включая высококачественное обеспечение данными, общедоступные интеллектуальные вычислительные сервисы, обмен открытой экосистемой, промышленное внедрение, подготовку кадров, разработку стандартов, безопасное управление и ответственный ИИ.
Вычислительная инфраструктура остается одной из ключевых тем конференции. В отличие от прошлогодних запусков, сосредоточенных на отдельных чипах-ускорителях, WAIC 2026 уделяет больше внимания суперузлам, высокоскоростным соединениям, разделяемой памяти, системам на уровне стоек и крупномасштабной интеграции кластеров.
Компании Huawei, Alibaba Cloud, Kunlun Core, Biren Technology, Muxi и Sugon продемонстрировали системы, предназначенные для объединения десятков, сотен и даже тысяч ускорителей в более крупные вычислительные блоки.
Конкуренция в области AI-инфраструктуры вышла за пределы уровня отдельных чипов
Производительность отдельных ускорителей по-прежнему важна, но обучение больших моделей и высоконагруженный инференс все больше зависят от производительности всей системы.
Суперузлы соединяют несколько AI-ускорителей с помощью высокопропускной малозадержковой сети расширения. Цель — заставить большую группу процессоров работать как тесно интегрированный компьютер, а не как набор отдельных серверов.
Этот подход особенно применим для:
- Обучения моделей с сотнями миллиардов или триллионами параметров
- Обслуживания крупных моделей типа «смесь экспертов»
- Совместного использования ресурсов памяти между несколькими ускорителями
- Снижения накладных расходов на связь в процессе распределенных вычислений
- Поддержки высоконагруженного инференса для агентных и корпоративных сервисов
- Построения более крупных кластеров на основе стандартизированных блоков стоек или узлов
Продукты, представленные на WAIC 2026, показывают, что китайская вычислительная индустрия переходит от конкуренции на уровне чипов к конкуренции в таких областях, как протоколы соединений, архитектура памяти, серверная инженерия, охлаждение, сети, системное ПО и эксплуатация кластеров.
Системы суперузлов, представленные на WAIC 2026
В таблице ниже приведены основные системы и их характеристики, упомянутые в ходе конференции.
| Поставщик | Продукт или система | Заявленный масштаб | Основные характеристики |
|---|---|---|---|
| Huawei | Atlas 950 SuperPoD | Демонстрационная конфигурация включает 1024 ускорителя | 1 EFLOPS FP8, 2 EFLOPS FP4, 256 ТБ глобально адресуемой памяти, пропускная способность межсоединений NPU на уровне ТБ, задержка в обе стороны 3 микросекунды |
| Alibaba Cloud | Экземпляр суперузла Lingjun Zhenwu M890 | 64 вычислительные карты | Поддержка FP8/FP4, ICN Switch 1.0, межкарточное соединение 800 ГБ/с, поддержка инференса MoE-моделей с 10 триллионами параметров |
| Kunlun Core | Суперузлы на 32 и 64 карты | Масштабируется до 512 карт | Высокоплотная интеграция для отечественных AI-ускорителей; по сообщениям СМИ, передан в серийное производство |
| Biren Technology | Матрица суперузлов BR2xx и BLink 2.0 | До 1024 GPU | NPO-оптические соединения, распределенная декамблинг-архитектура, разделяемое адресное пространство памяти между суперузлами |
| Muxi | Xijing S600 | 64 GPU на стойку | Высокоплотное развертывание, полное межсоединение внутри стойки, масштабирование до кластеров на десятки тысяч карт |
| Sugon | Sugon 8000 "Dengfeng" | Суперкластер AI на 100 000 карт | Отечественный стек ПО и аппаратного обеспечения, подключение к Национальной суперкомпьютерной сети |
Приведенные выше данные основаны на публичных заявлениях и сообщениях СМИ во время WAIC 2026 и описывают различные системные конфигурации; их не следует рассматривать как прямое сравнение по однородным критериям.
Huawei демонстрирует суперузел Atlas 950
Huawei впервые публично продемонстрировала физический суперузел Atlas 950 на WAIC.
Демонстрационная конфигурация, на которой был сделан акцент на конференции, соединяет 1024 ускорителя Shengteng с помощью Huawei UnifiedBus и архитектуры суперузла. Huawei опубликовала следующие данные:
- Производительность FP8: 1 EFLOPS
- Производительность FP4: 2 EFLOPS
- Глобально адресуемая память: 256 ТБ
- Пропускная способность межсоединений NPU: уровень ТБ
- Задержка в обе стороны: до 3 микросекунд
Продукт предназначен для крупных центров обработки данных, обучения моделей с триллионами параметров и высоконагруженного инференса.
Значение его конструкции выходит за рамки простого суммирования пиковой производительности. Единая адресация памяти и снижение задержек связи уменьшают необходимость перемещения данных между традиционными серверами, что критически важно для задач, интенсивно использующих связь, таких как маршрутизация «смеси экспертов», распределенный доступ к кэшу ключ-значение и массовое параллельное обучение.
Huawei также описала более крупные варианты развертывания Atlas 950, выходящие за рамки конфигурации на 1024 карты, показанной на WAIC. Конкретные данные в этой статье взяты из отчетов первоисточников и заявлений Huawei на WAIC.
Alibaba Cloud запускает публичный облачный экземпляр суперузла
Alibaba Cloud официально представила экземпляр суперузла Lingjun Zhenwu M890 — свою первую услугу AI-вычислений в форме суперузла, предоставляемую через публичное облако.
Услуга предоставляет вычислительный блок на 64 карты с высокой скоростью внутренних соединений, готовый к немедленному использованию. Поддерживаются вычисления с низкой точностью FP8 и FP4, используется собственная микросхема соединений Alibaba ICN Switch 1.0.
Согласно информации о запуске:
- Масштаб домена расширения увеличен с 16 до 64 карт
- Пропускная способность межкарточных соединений: 800 ГБ/с
- Один экземпляр может поддерживать инференс MoE-моделей с 10 триллионами параметров
- Открыто для тестирования по приглашению в регионе Alibaba Cloud Уланчаб
Предоставление этой услуги в виде облачного экземпляра снижает начальный порог развертывания. Клиенты могут оценить тесно связанный суперузел без необходимости предварительно закупать, устанавливать и обслуживать полную стоечную систему.
Модель также перекладывает на поставщика услуг задачи по обслуживанию оборудования, сетей, мониторинга и большей части базовых операций.
Kunlun Core представляет суперузлы на 32 и 64 карты
Kunlun Core также продемонстрировала свои продукты суперузлов на конференции.
Согласно сообщениям СМИ, их системы на 32 и 64 карты являются одними из первых в Китае, переданных в серийное производство. Конструкция использует высокоплотную интегрированную архитектуру: одна стойка поддерживает 32 или 64 карты ускорителя, с возможностью масштабирования до конфигурации на 512 карт.
Существующая линейка продуктов Kunlun Core включает AI-ускорители и многокарточные ускорительные группы для крупномасштабного обучения и инференса в облачных ЦОД.
Поскольку конкретные параметры продуктов на WAIC были опубликованы в основном через СМИ, а не через специализированные технические страницы, перед принятием решений о закупках или инженерных проектах рекомендуется напрямую уточнить у производителя статус развертывания и производительность.
Biren Technology представляет оптический и декамблинг-дизайн суперузлов
Biren Technology представила свою стратегию суперузлов следующего поколения, основанную на:
- Близкой к корпусу оптике (NPO)
- Распределенной декамблинг-архитектуре
- Ускорителях BR2xx
- Протоколе соединений BLink 2.0
Система позволяет расширить один суперузел до 1024 GPU.
Biren заявляет, что BLink 2.0 поддерживает совместное использование единого адресного пространства памяти до 1024 GPU. Более широкий портфель продуктов включает:
- Стандартный серверный суперузел на 16 карт с электрическими соединениями
- Высокоплотный стоечный суперузел на 128 карт с электрическими соединениями
- Распределенный суперузел на 1024 карты с оптическими соединениями NPO
По мере увеличения количества ускорителей и физического расстояния важность оптических соединений возрастает. Электрические соединения эффективны внутри серверов и стоек, но при большем масштабе возрастают сложности с энергопотреблением, целостностью сигнала и управлением расстоянием.
Распределенная конструкция Biren отражает более широкую отраслевую тенденцию: разделение вычислительных компонентов, памяти, коммутаторов и оптических модулей при сохранении тесно связанной логической системы.
Muxi представляет Xijing S600
Muxi официально выпустила новый продукт AI-суперузлов Xijing S600, предназначенный для обучения моделей, инференса и центров AI-вычислений.
Продукт поддерживает:
- Интеграцию 64 GPU в одной стойке
- Высокоскоростное полное соединение между GPU
- Высокоплотное развертывание
- Многомерные стратегии параллелизма для больших моделей
- Масштабирование до кластеров, включающих десятки тысяч ускорителей
Muxi позиционирует S600 как системный продукт, а не как отдельный GPU-сервер; его конструкция подчеркивает совместную оптимизацию аппаратного обеспечения, сетей и ПО.
Компания также поддерживает гетерогенную вычислительную платформу MXMACA и экосистему разработчиков для адаптации моделей и развертывания приложений.
Sugon 8000 знаменует тенденцию создания стотысячных кластеров
Sugon 8000 (также известный как Dengfeng) совершил свою мировую физическую премьеру на WAIC.
В начале июля Sugon объявила, что эта система является первым в Китае полностью отечественным AI-суперкластером на 100 000 карт. Продукт уже подключен к Национальной суперкомпьютерной сети, что знаменует переход от кластеров с десятками тысяч ускорителей к развертываниям масштаба ста тысяч карт.
Система объединяет следующие технологии:
- Отечественные вычислительные ускорители
- Сеть Sugon ScaleFabric RDMA
- Распределенное хранилище ParaStor
- Иммерсионное фазовое жидкостное охлаждение
- Поддержка различных форматов точности от FP64 до INT8
- Подключение через Национальную интегрированную вычислительную сеть
Кластер предназначен для поддержки научных вычислений, обучения больших моделей, AI-инференса, промышленного моделирования, биомедицины, исследований материалов и других крупномасштабных вычислительных задач.
Развертывание на стотысячных картах — это не суперузел в традиционном понимании, а суперкластер, состоящий из множества тесно связанных вычислительных и инфраструктурных компонентов. Его реальная ценность зависит от эффективности масштабирования приложений, утилизации ресурсов, пропускной способности хранилища, надежности сети, планирования задач и эксплуатационных затрат.
Отечественные AI-вычисления переходят к взаимосвязям и системной интеграции
Информация, опубликованная на Всемирной конференции по искусственному интеллекту (WAIC), четко отражает сдвиг в конкурентной среде.
Один чип может обеспечить высокую теоретическую вычислительную мощность, но большие модели требуют работы в кросс-системной среде. Когда сотни или тысячи ускорителей соединяются вместе, общая производительность все больше зависит от:
- Пропускной способности вертикального масштабирования межсоединений
- Горизонтально масштабируемой сети
- Разделяемой или глобально адресуемой памяти
- Библиотек коллективных коммуникаций
- Планирования задач
- Распределенного хранения данных
- Охлаждения и электропитания
- Изоляции и восстановления после сбоев
- Адаптации моделей и операторов
- Программного обеспечения управления кластером
Ссылаясь на первоначальный отчет, China Securities Co., Ltd. (中银证券) считает, что конкуренция в отечественной вычислительной сфере распространяется на возможности межсоединения чипов и системной интеграции.
По мере того как производители расширяют линейку суперузлов, крупномасштабное развертывание может также стимулировать спрос на следующие вспомогательные технологии:
- Высокоскоростные медные и оптические соединения
- Сетевые коммутаторы
- Оптические модули
- Системы жидкостного охлаждения
- Оборудование для передачи электроэнергии
- Стоечная интеграция
- Распределенное хранение данных
- Программное обеспечение управления кластером
Эта точка зрения является отраслевым анализом, а не обещанием рыночных показателей. Фактическое развертывание будет зависеть от доступности продукта, стабильности, потребностей клиентов, ценообразования, зрелости программного обеспечения и экономической эффективности эксплуатации системы.
AI-телефоны и роботизированные телефоны становятся агентными платформами
Всемирная конференция по искусственному интеллекту 2026 года также продемонстрировала несколько моделей AI-телефонов и роботизированных телефонов.
Первоначальный отчет указывает, что смартфоны могут эволюционировать от контейнеров для отдельных приложений к платформам для работы постоянных AI-агентов. В этой модели важность операционной системы и входных точек на уровне устройств становится все более заметной.
Агентам не нужно открывать отдельные приложения для каждой задачи; вместо этого они могут координировать такие сервисы, как связь, поиск, путешествия, платежи, офисная работа, камеры, датчики и устройства Интернета вещей.
Представленная на конференции агентная операционная система StepFun's Agent OS рассматривается как еще одно свидетельство того, что агенты спускаются с уровня приложений на уровень операционной системы.
Операционная система, ориентированная на агентов, помогает координировать:
- Смартфоны
- Промышленное оборудование
- Транспортные средства
- Устройства Интернета вещей
Гуманоидные роботы
- Другие интеллектуальные терминалы
Эта концепция все еще развивается, и возможности продуктов значительно различаются. Настоящая агентная платформа на уровне устройства должна обрабатывать разрешения, конфиденциальность, аутентификацию, межприкладное выполнение, надежность, безопасность и получать явное одобрение пользователя для операций, которые могут иметь серьезные последствия.
Воплощенный ИИ и отраслевые приложения в центре внимания
Воплощенный интеллект и вертикальные приложения стали еще одним ключевым направлением конференции.
Гуманоидные роботы, роботы-собаки, ловкие манипуляторы и другие физические AI-системы были широко представлены на выставке. Эти продукты демонстрируют, как отрасль пытается соединить фундаментальные модели с датчиками, системами управления, механическим оборудованием и реальными рабочими процессами.
В цитируемой исходной статье отмечается, что Haitong Securities считает одним из важнейших вопросов WAIC, сможет ли отечественная AI-индустрия построить полную цепочку поставок, охватывающую:
- Вычислительную инфраструктуру
- AI-чипы и системы
- Фундаментальные модели
- Агентные операционные системы
- Интеллектуальные устройства
- Воплощенных роботов
- Отраслевые приложения
Акцент смещается с единичных технологических прорывов на системную коммерциализацию и поставку.
Для клиентов полное решение не может просто демонстрировать модель или робота на стенде. Оно должно быть надежным, обслуживаемым, безопасным, экономически жизнеспособным и интегрируемым в существующие бизнес-процессы.
Направление AI-инфраструктуры, выявленное на WAIC 2026
Анонсы суперузлов показывают, что отечественные вычислительные компании больше не демонстрируют только чипы-ускорители.
Они строят более широкие платформы, интегрирующие следующие элементы:
- Чипы
- Память
- Межсоединения
- Серверы
- Стоечные суперузлы
- Оптические сети
- Хранение данных
- Охлаждение
- Системное программное обеспечение
- Облачные сервисы
- Адаптацию моделей
- Поставку приложений
Это не означает, что каждая объявленная система достигла одинакового уровня зрелости или доступности. Некоторые продукты уже находятся на стадии коммерческой поставки, некоторые — на этапе пригласительного тестирования, а другие представляют собой недавно объявленные архитектуры или планы расширения.
Общее направление важнее любого отдельного параметра: конкуренция в области AI-инфраструктуры смещается с производительности одного чипа на эффективную производительность всей системы.
Часто задаваемые вопросы
Что такое AI-суперузел?
AI-суперузел — это тесно связанный кластер ускорителей, предназначенный для работы в качестве более крупного вычислительного блока. Обычно он использует высокопропускные, малозадерживающие сети расширения и может предлагать разделяемую или глобально адресуемую память.
Чем суперузел отличается от традиционного GPU-кластера?
Традиционные кластеры обычно соединяют отдельные серверы через горизонтально масштабируемую сеть, тогда как суперузлы обеспечивают более тесную внутреннюю связь, меньшую задержку связи и более быструю передачу данных между ускорителями до того, как несколько суперузлов объединяются в более крупный кластер.
Что такое Huawei Atlas 950 SuperPoD?
Atlas 950 SuperPoD — это AI-вычислительная система Huawei на базе Ascend. Конфигурация, показанная на WAIC 2026, подключает 1024 ускорителя, имеет номинальную вычислительную мощность 1 EFLOPS FP8 и 2 EFLOPS FP4, а также 256 ТБ глобально адресуемой памяти.
Что такое облачный суперузел Alibaba Cloud Lingjun Zhenwu M890?
Это экземпляр суперузла в публичном облаке, построенный как вычислительный блок на 64 карты с возможностью мгновенного развертывания. Alibaba Cloud заявляет, что он поддерживает FP8 и FP4, обеспечивает пропускную способность межсоединений между картами 800 ГБ/с и может обслуживать очень большие модели смешанных экспертов.
Почему высокоскоростные межсоединения важны для больших AI-моделей?
Распределенные AI-задачи требуют частого обмена состояниями моделей, градиентами, активациями, данными маршрутизации экспертов и кэшем ключей и значений. Медленная или перегруженная связь может привести к простою дорогих ускорителей в ожидании данных, что значительно снижает эффективную производительность системы.
Что такое система Shuguang 8000 Dengfeng?
Shuguang 8000 — это полностью самостоятельно разработанный AI-суперкластер на стотысячных картах, уже подключенный к Китайской национальной суперкомпьютерной сети. Он предназначен для AI-задач, научных вычислений, промышленного моделирования и других крупномасштабных приложений.
Означает ли большее количество карт обязательно более высокую производительность?
Не обязательно. Производительность приложения также зависит от эффективности связи, пропускной способности памяти, оптимизации программного обеспечения, планирования, хранения данных, надежности и утилизации. Две системы с одинаковым количеством карт могут показывать совершенно разные результаты.
Почему на WAIC также уделяется большое внимание Agent OS и воплощенному интеллекту?
Отрасль переходит от отдельных моделей к агентам, которые работают совместно на устройствах и роботах. Агентные операционные системы, интеллектуальные терминалы и воплощенные интеллектуальные системы — это попытки преобразовать возможности моделей в постоянное выполнение задач в реальном мире.
Связанные инструменты
- Huawei Ascend: Официальная платформа Huawei Ascend для AI-оборудования, программного обеспечения, инструментов разработки и документации.
- Alibaba Cloud: Облачная платформа Alibaba для AI-вычислений, обслуживания моделей, инфраструктуры данных и корпоративных задач.
- Kunlunxin: Официальный сайт AI-чипов, ускорительных карт и интеллектуальных вычислительных продуктов Kunlunxin.
- Biren Technology: Официальный сайт GPU Biren, программной платформы BIRENSUPA и технологий оптических межсоединений.
- MetaX: Официальный сайт GPU MetaX, серверов, суперузлов и вычислительной платформы MXMACA.
- Sugon: Официальный сайт вычислительных систем, хранения данных, сетей, охлаждения и суперкомпьютерных систем Sugon.
Связанные ссылки
- Huawei Atlas 950 SuperPoD представлен на WAIC 2026: Официальный анонс Huawei о системе, показанной на конференции.
- План действий по сотрудничеству и развитию AI: Официальные восемь планов сотрудничества в области AI, опубликованные Государственным комитетом по развитию и реформам Китая.
- Итоги WAIC 2026 от NDRC: Официальная справочная информация о плане действий и конференции.
- [Официальный сайт Kunlunxin](https://www.kunlunxin.
com/) — официальная информация о продуктах и компании, связанных с ускорителями Kunlun Core и интеллектуальными вычислительными системами.
- Официальный сайт Birentech — официальные данные о продуктах и компании Birentech.
Информация об ускорителях, программном обеспечении и оптических межсоединениях Birentech:
- Официальный сайт MetaX — официальные сведения о графических процессорах MetaX, суперузлах и ресурсах для разработчиков.
- Обзор Shuguang 8000 — правительственный специальный отчет о национальном суперкластере ИИ масштаба ста тысяч карт и его взаимодействии с национальной супервычислительной сетью.
Резюме
Выставка WAIC 2026 года показала, что китайская инфраструктурная индустрия ИИ переходит от отдельных ускорителей к системным решениям. Huawei, Alibaba Cloud, Kunlun Core, Birentech, MetaX и Shuguang представили решения, основанные на суперузлах, высокоскоростных межсоединениях, разделяемой памяти, интеграции в цельные стоечные системы и кластерах сверхбольшого масштаба.
Опубликованные на выставке модели развертывания включают: локальные суперузлы, облачные экземпляры, архитектуры оптических межсоединений, стоечные GPU-системы и национальные суперкластеры масштаба ста тысяч карт.
На уровне устройств и приложений операционные системы для агентов ИИ, AI-телефоны, роботы и вертикальные отраслевые системы знаменуют собой значительный сдвиг от демонстрации моделей к интегрированным поставкам.
Ключевым прорывом WAIC 2026 года стало не повышение производительности отдельных чипов, а полное возникновение архитектуры целостных AI-вычислительных систем, способных подключать, масштабировать и управлять отечественными ускорителями в производственной среде.