China Telecom развертывает в Ханчжоу первый собственный кластер TPU: TPU Чжунхао Синьин Чанa с 400 PFLOPS, вычислительная цепочка национального уровня от чипа до платформы

Tpu отечественные чипы кластер China Telecom Zte Xuyu pandaily.com

Первый отечественный кластер TPU развернут в Ханчжоу: 1024 чипа, 400 PFLOPS. Планируется расширение до 10 000+ PFLOPS. Узнайте о технологии PD-разделения и преимуществах TPU второго поколения Xuyu.

China Telecom, ZTE и Zhonghao Xinying развернули первый отечественный кластер TPU: 1024 чипа в Ханчжоу производительностью 400 PFLOPS. Первое поколение Chana TPU обеспечивает фазу 1; второе поколение Xuyu TPU (WAIC 2026) предлагает 896 TFLOPS, что в 3 раза превышает производительность Chana при снижении энергопотребления на 50%.

Операторы связи становятся критически важной средой валидации для отечественных ИИ-чипов. В отличие от облачных провайдеров, которые могут оптимизироваться под конкретные модели GPU, операторы связи обслуживают разнообразных корпоративных клиентов, требующих широкой совместимости моделей. Hangzhou Telecom сообщил, что эффективность вывода токенов на кластере после развертывания улучшилась более чем в 10 раз, а стоимость за миллион токенов снизилась с примерно 100 юаней до менее 10 юаней. Кластер достиг этих результатов благодаря планированию с разделением Prefill-Decode — технике, которая разделяет обработку ввода и генерацию вывода для оптимизации использования оборудования под каждый тип нагрузки. Разделение PD является родным для архитектуры TPU, в то время как для GPU требуется существенная модификация ПО для достижения эквивалентной производительности.

Генеральный директор Zhonghao Xinying Ян Гунъифань, бывший участник команды Google TPU, позиционирует компанию как одну из немногих китайских компаний, приверженных архитектурному пути TPU. Архитектура TPU с систолическими массивами и крупномасштабными блоками матричного умножения изначально оптимизирована для вычислительной логики слоев трансформера — доминирующего паттерна в больших языковых моделях. Чип второго поколения Xuyu поддерживает нативное планирование с разделением PD, что значительно снижает затраты на модификацию ПО. В кластерном развертывании один суперузел поддерживает прямое соединение до 2048 чипов, решая проблему межчипового взаимодействия, которая становится критической при масштабе в тысячи карт, когда требования к пропускной способности достигают терабитных уровней.

Отечественные чипы сталкиваются с адаптацией на 100 уровней против 10 уровней для зарубежных, поскольку и модели, и чипы обновляются одновременно со спринтерской скоростью. China Telecom предоставляет реальное пространство ЦОД, реальные рабочие нагрузки и реальные счета, чтобы перевести чипы из состояния «может работать» в состояние «работает хорошо».

Запланировано расширение до 10 000+ PFLOPS для обучения сверхбольших моделей. Эволюция от конкуренции на уровне чипов к конкуренции на уровне систем отражает зрелость отрасли. Партнерство Zhonghao Xinying, ZTE и China Telecom создает вертикально интегрированную национальную вычислительную цепочку поставок.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: