NVIDIA готовит возвращение в Китай с новым чипом инференса на базе «LPU», а SMIC, используя экспортные ограничения США, идёт к фактической монополии в Китае

Nvidia Groq Lpu китай экспортный контроль чип wccftech.com

NVIDIA разрабатывает чип для Китая с LPU от Groq, чтобы обойти экспортные ограничения США. Узнайте, как компания балансирует между спросом и запретами, пока китайские игроки (SMIC, Alibaba, DFSX) создают собственные решения.

NVIDIA пытается пройти по лезвию ножа, обслуживая свою огромную клиентскую базу в Китае, балансируя между эффективностью своих продуктов, предназначенных для Китая, и ограничениями, наложенными масштабными экспортными контролями США.

Сейчас, когда Пекин активно discourages предприятия от импорта NVIDIA H200 GPU, которые администрация Трампа специально разрешила для использования в Китае, NVIDIA, по-видимому, пытается найти другой путь, чтобы обеспечить ценность для своих китайских клиентов, оставаясь в рамках экспортных ограничений США. Этот узкий путь, судя по всему, сосредоточен на LPU от Groq.

NVIDIA, по-видимому, разрабатывает чип для Китая, использующий LPU от Groq, чтобы предложить привлекательное решение для рабочих нагрузок AI-инференса

The Information сообщает, что NVIDIA планирует возвращение в Китай, разрабатывая новый чип, ориентированный на инференс, для Китая. По-видимому, новый чип будет готов к концу года и будет оснащен Language Processing Units (LPU) от Groq.

Для тех, кто не в курсе: NVIDIA заключила с Groq соглашение о лицензировании технологий и передаче активов/талантов в декабре 2025 года. LPU от Groq объединяют сотни или даже тысячи специализированных чипов, где каждый отдельный чип содержит гигантские блоки Matrix Multiply (MXM) и Vector (VXM), а также около 230 МБ сверхбыстрой SRAM. Кроме того, веса моделей AI напрямую «зашиваются» в SRAM, полностью минуя концепцию кэш-памяти.

Ключевой момент: в LPU нет предсказателей ветвлений или аппаратных планировщиков. Вместо этого компилятор Groq планирует каждое вычисление с точностью до наносекунды, обеспечивая непрерывную, тщательно спланированную подачу соответствующих данных из SRAM для обработки, что приводит к чрезвычайно быстрому инференсу.

Согласно The Information, новый чип NVIDIA будет соответствовать экспортным ограничениям США, которые в основном определяют, сколько HBM может поддерживать конкретный AI-ускоритель, ориентированный на Китай, а также обычно запрещают передовые технологии упаковки, такие как CoWoS.

Китай находит креативные способы обхода экспортных ограничений США, а SMIC фактически получает монополию внутри страны

Тем временем экспортные ограничения США оборачиваются хорошим бизнесом для китайской SMIC, которая является единственным в Азии производителем по техпроцессу 7 нм, с уровнем загрузки мощностей 93,7%, последним квартальным доходом в 3,01 млрд долларов (рост на 36,1% год к году) и чистой прибылью, почти утроившейся до 479,2 млн долларов.

Кроме того, китайские предприятия применяют креативные обходные пути для борьбы с экспортными ограничениями США. Например, Alibaba представила XuanTie C950 в марте 2026 года, позиционируя чип как решение на базе RISC-V для edge AI. В отличие от типичных ASIC, XuanTie C950 не полагается на GPU для AI-нагрузок. Вместо этого чип представляет собой серверный 64-битный процессор RISC-V с 64 вычислительными ядрами на одном кристалле, тактовой частотой до 3,20 ГГц, где несколько кластеров (по 8 ядер) нативно связаны между собой с помощью высокоскоростных шин AMBA CHI. Более того, для обработки требовательных AI-нагрузок в чип встроены матричные и векторные ускорители, что устраняет необходимость в GPU.

На другом конце спектра чип DFSX DF1000 изготавливается по зрелому техпроцессу 14 нм, но использует новую 3D-архитектуру near-memory compute, где память располагается непосредственно поверх вычислительного слоя и соединяется с помощью 3D-гибридного соединения на уровне пластины, которое сплавляет медные дорожки двух слоев, полностью устраняя микроконтакты или провода, и действует как десятки миллионов сверхбыстрых вертикальных лифтов вместо одной горизонтальной магистрали.

Более того, чип DF2000, который ожидается в четвертом квартале 2026 года на техпроцессе 14 нм, идет еще дальше. Вместо того чтобы размещать только один слой памяти поверх вычислительного слоя, DF2000 объединяет несколько многослойных башен «память-вычисления» рядом друг с другом на базовой подложке в технике, которую DFSX называет 3.5D Infinity Chiplet. Чип по сути заменяет базовые слои хранения на специально спроектированную 3D-структуру DRAM, значительно увеличивая объем временных данных, которые могут храниться непосредственно внутри его структуры.

Наконец, обратите внимание, что секретная китайская компания под названием Shanghai Aishegna вышла на рынок DUV-литографии, планируя произвести 5 DUV-машин в этом году и еще 20 в следующем. На фоне этой быстро меняющейся ситуации, похоже, NVIDIA почувствовала необходимость в новом подходе, чтобы сохранить свое присутствие в Китае.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: