В первой половине эры инфраструктуры ИИ предположение было простым: чем больше чип, тем лучше. Всемирная конференция по искусственному интеллекту 2026 года в Шанхае стала моментом, когда это предположение официально умерло. Доминирующий мотив — уже не терафлопсы на одной плате, а суперноды — стоечные системы, которые связывают сотни и тысячи ускорителей в единую ткань с общей памятью. Гонка теперь идет за эффективность на уровне системы, а не за пиковую производительность чипа.
Biren Tech закрепилась в лагере оптических межсоединений. Ее оптический супернод NPO на 1024 карты использует собственный протокол BLink 2.0 и оптику, близкую к корпусу, чтобы продвигать «медь наружу, свет внутрь» в домене масштабирования. До 1024 GPU разделяют единое унифицированное пространство памяти. Матрица продуктов варьируется от электрического базового уровня на 16 карт до высокоплотной стойки на 128 карт и оптического супернода на 1024 карты.
Yixin Intelligent пошла в другом направлении. Ее анонс на WAIC стал первым в отрасли супернодом на RISC-V для ИИ, основанным на собственном облачном ИИ-чипе Epoch — первом в Китае серийном высокопроизводительном ускорителе ИИ на RISC-V. Epoch уже поддерживает блочно-квантованную точность FP8, а в следующем поколении перейдет на EXFP4 и MXFP4. Супернод использует ортогональное межсоединение без объединительной платы, что снижает стоимость аппаратного обеспечения межсоединений на 80% и сокращает задержки до диапазона сотен наносекунд.
Остальная часть выставочного зала представляла собой обзор конкурирующих философий. Infinigence CoreX продвигала плотные универсальные тренировочные чипы. Kunlun Chip, выделенное подразделение ускорителей Baidu, представила архитектуру третьего поколения. SingularMOL продемонстрировала межсоединение на основе чиплетов. Infinigence, облачный оркестратор от Infinigence Cloud, показала программную историю: уровень диспетчеризации, который может объединять фрагментированное отечественное оборудование в единый виртуальный суперкластер.
Экономический смысл, лежащий в основе, неприятен. GPU в плохо соединенном кластере большую часть времени проводят в ожидании данных. Пропускная способность, а не вычислительная мощность, теперь является сдерживающим фактором для обучения и инференса. Коммуникационные барьеры означают, что установка тысячи карт в стойку без стратегии межсоединений на уровне системы дает «коэффициент конверсии токенов», который может составлять десятую часть от теоретического. Китайские поставщики супернодов конкурируют за полезные токены на доллар капитальных затрат.
Выбор оборудования больше не является решением одного поставщика. Разумная китайская ИИ-лаборатория в 2026 году купит как минимум два разных ускорителя и обернет их в программный слой, который распределяет задачи между поставщиками. Лаборатории, которые создадут этот уровень оркестрации, будут владеть следующим узким местом. WAIC 2026 запомнится как год, когда китайские поставщики инфраструктуры ИИ перестали продавать чипы и начали продавать системы.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Pandaily




