Спрос на вычислительные мощности для ИИ уже практически ненасытен, и, похоже, он только возрастет после появления передовых открытых моделей, таких как Kimi K3, которые любой желающий может донастроить и развернуть. На этом фоне Microsoft и AMD объединяют усилия, чтобы обеспечить Редмонду больше AI FLOPS как для внутреннего, так и для внешнего использования. Сегодня утром компании объявили, что Microsoft обязуется в промышленных масштабах внедрять стоечный ИИ-ускоритель AMD Helios для выполнения задач с передовыми моделями в собственных дата-центрах, а также для клиентов инфраструктуры Azure AI и соответствующих сервисов.
Партнерство делает ИИ-вычисления AMD нового поколения доступными для клиентов Azure, таких как ИИ-лаборатории, для задач обучения и инференса моделей, а также ляжет в основу управляемых вычислений для корпоративных заказчиков, желающих развертывать ИИ-нагрузки через Microsoft Foundry.
Компании не указали точный объем развертывания Helios у Microsoft ни в ваттах, ни в долларах, но это обязательство, похоже, станет еще одной крупной победой AMD, стремящейся отвоевать долю рынка дата-центровых GPU у Nvidia. AMD заключила масштабные партнерства с OpenAI и Meta* за последний год, где на кону стоят гигаватты вычислительных установок и потенциально сотни миллиардов долларов.
Напомним, что стоечный ускоритель Helios составит конкуренцию системе Nvidia Vera Rubin NVL72, когда появится позднее в этом году. Helios объединяет 72 новейших GPU Instinct MI455X с совокупным объемом памяти HBM4 в 31,1 ТБ. Эти GPU обеспечивают до 1,4 эксафлопс вычислений FP8 и 2,9 эксафлопс FP4 для ИИ-моделей, использующих эти типы данных OCP AI.
AMD нацелена на пропускную способность масштабирования внутри стойки в 260 ТБ/с, что сопоставимо с системой Nvidia Vera Rubin NVL72, и 43 ТБ/с пропускной способности масштабирования с использованием UALink через Ethernet, что примерно вдвое превышает показатели Vera Rubin, хотя производительность UALink через Ethernet на практике еще предстоит оценить.
Microsoft и AMD также объявили, что Azure добавит две новые серии виртуальных машин на базе грядущих процессоров AMD Epyc Venice шестого поколения: серию HDv2 для «агентного ИИ и конвейеров данных» и HXv2 для проектирования полупроводников. Microsoft также использует существующее развертывание DPU AMD Pensando для интеграции этого оборудования в свои предложения Azure Boost с целью ускорения операций обработки сетевых данных и хранения.
Tom’s Hardware будет присутствовать на мероприятии AMD Advancing AI на этой неделе, где мы ожидаем узнать больше об амбициях AMD в области ИИ на вторую половину этого года и далее. Следите за нашими репортажами с этого мероприятия.
Facebook*, Instagram* и WhatsApp* принадлежат компании Meta* Platforms Inc., деятельность которой признана экстремистской и запрещена на территории Российской Федерации.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Jeffrey Kampman




