Сообщается, что Гугл привлёк AMD к разработке TPU нового поколения

Google Amd Tpu Cpu ии ускорители tomshardware.com

По слухам, Google может создавать TPU с встроенными на подложку CPU-ядрами специально для агентных и RL-нагрузок. Узнайте, какую роль в этом играет AMD и почему будущее ИИ может стать более CPU-ориентированным.

Google объединился с AMD для разработки одного из своих TPU десятого поколения, согласно заметке SemiAnalysis (через Шона). Аналитики SemiAnalysis полагают, что Google может быть заинтересована в процессорных ядрах AMD для задач с высокой нагрузкой на CPU. Если это подтвердится, сотрудничество станет первым крупным участием AMD в проекте по созданию заказного AI ASIC и может указывать на то, что Google изучает новый тип TPU, сочетающий собственные технологии ускорителей с встроенными ядрами общего назначения для задач с высокой нагрузкой на CPU. «Рыночные разговоры говорят о том, что [Google] работает с AMD над проектом TPU в поколении v10», — говорится в заметке SemiAnalysis для клиентов, которую цитирует Шон. «Участие AMD стало бы первым реальным вовлечением в проект заказного AI ASIC, несмотря на наличие собственной команды по заказным чипам. AMD обладает сильным IP, особенно в области передовой упаковки и SoIC. Кроме того, CPU IP также может быть привлекательным, учитывая, что Google и её клиенты стремятся к TPU с встроенными на подложку CPU-ядрами для задач RL». Разработав девять поколений собственных AI-ускорителей (при этом фактическим разработчиком кремния выступала Broadcom) и обладая обширным опытом в архитектуре ускорителей, Google едва ли нуждается в AMD для проектирования обычного TPU. Следовательно, вероятность того, что AMD реализует TPU v10i Google для инференса или V10t для обучения, невелика. Таким образом, Google может потребоваться нечто, что может предоставить только производитель CPU, например AMD, включая CPU IP, программируемую логику, интерконнекты или определённые знания в области передовой упаковки. Из этого особенно примечателен аспект CPU. SemiAnalysis утверждает, что Google и её клиенты стремятся к TPU со встроенными на подложку CPU-ядрами для обучения с подкреплением и, возможно, других задач с высокой нагрузкой на CPU. В то время как обычное обучение LLM остаётся преимущественно ориентированным на ускорители, обучение с подкреплением для моделей рассуждения и агентных моделей может требовать значительно большего объёма вычислений общего назначения вокруг операций ускорителя. Google уже начала увеличивать ресурсы CPU вокруг своих последних TPU, ориентированных на инференс. Системы TPU 8i, предназначенные для инференса, рассуждения и задач RL, содержат один Google Axion CPU на каждые два TPU. Для сравнения, серверы с TPU седьмого поколения Google использовали один процессор Xeon ‘Emerald Rapid’ на каждые четыре TPU. Более того, мы слышим, что в некоторых случаях оптимальным является соотношение CPU к ускорителям 1:1, так что будущее ИИ может быть гораздо более загруженным CPU, чем мы думаем. Тем временем внедрение ядер CPU непосредственно в корпус TPU может стать логичным следующим шагом, поскольку сокращение расстояния между вычислениями общего назначения и тензорными вычислениями может повысить производительность и снизить энергопотребление. Здесь на сцену выходит AMD, так как она уже имеет опыт разработки дизайна уровня дата-центра — Instinct MI300A, который объединяет как x86, так и ускорительные чиплеты. Гипотетический дизайн Google мог бы объединить разработанные Google вычислительные чиплеты TPU с CPU и HBM от AMD в плотно интегрированном корпусе, созданном AMD. Возможно, Intel также могла бы стать потенциальным кандидатом, учитывая множество стратегических партнёрств Google и Intel. Однако у Intel нет опыта создания гибридных дизайнов дата-центров с x86 и ускорителями. Обратите внимание: пока мы строим предположения, и наш анализ может быть неточным. На данный момент характер предполагаемого участия AMD остаётся неясным. Тем не менее, если отчёт действительно точен, важным событием может быть не то, что AMD помогает Google построить очередной TPU. Вместо этого значение имеет то, что Google рассматривает новый член семейства TPU v10, ориентированный на высокую нагрузку CPU, оптимизированный специально для задач RL и агентных моделей, и использует AMD как поставщика некоторых строительных блоков, необходимых для его создания.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:

Похожие новости: