Microsoft масштабно развернёт стоечный ИИ-ускоритель AMD Helios в Azure — мощность Radeon Instinct MI455X и Epyc Venice станет доступна через облачную инфраструктуру Редмонда

Microsoft Amd Helios Azure ии ускорители tomshardware.com

Microsoft и AMD объединяют усилия, чтобы обеспечить Редмонду больше AI FLOPS. Узнайте, как партнерство с внедрением ускорителей Helios укрепит Azure и бросит вызов Nvidia.

Спрос на вычислительные мощности для ИИ уже практически ненасытен, и, похоже, он только возрастет после появления передовых открытых моделей, таких как Kimi K3, которые любой желающий может донастроить и развернуть. На этом фоне Microsoft и AMD объединяют усилия, чтобы обеспечить Редмонду больше AI FLOPS как для внутреннего, так и для внешнего использования. Сегодня утром компании объявили, что Microsoft обязуется в промышленных масштабах внедрять стоечный ИИ-ускоритель AMD Helios для выполнения задач с передовыми моделями в собственных дата-центрах, а также для клиентов инфраструктуры Azure AI и соответствующих сервисов.
Партнерство делает ИИ-вычисления AMD нового поколения доступными для клиентов Azure, таких как ИИ-лаборатории, для задач обучения и инференса моделей, а также ляжет в основу управляемых вычислений для корпоративных заказчиков, желающих развертывать ИИ-нагрузки через Microsoft Foundry.
Компании не указали точный объем развертывания Helios у Microsoft ни в ваттах, ни в долларах, но это обязательство, похоже, станет еще одной крупной победой AMD, стремящейся отвоевать долю рынка дата-центровых GPU у Nvidia. AMD заключила масштабные партнерства с OpenAI и Meta* за последний год, где на кону стоят гигаватты вычислительных установок и потенциально сотни миллиардов долларов.
Напомним, что стоечный ускоритель Helios составит конкуренцию системе Nvidia Vera Rubin NVL72, когда появится позднее в этом году. Helios объединяет 72 новейших GPU Instinct MI455X с совокупным объемом памяти HBM4 в 31,1 ТБ. Эти GPU обеспечивают до 1,4 эксафлопс вычислений FP8 и 2,9 эксафлопс FP4 для ИИ-моделей, использующих эти типы данных OCP AI.
AMD нацелена на пропускную способность масштабирования внутри стойки в 260 ТБ/с, что сопоставимо с системой Nvidia Vera Rubin NVL72, и 43 ТБ/с пропускной способности масштабирования с использованием UALink через Ethernet, что примерно вдвое превышает показатели Vera Rubin, хотя производительность UALink через Ethernet на практике еще предстоит оценить.
Microsoft и AMD также объявили, что Azure добавит две новые серии виртуальных машин на базе грядущих процессоров AMD Epyc Venice шестого поколения: серию HDv2 для «агентного ИИ и конвейеров данных» и HXv2 для проектирования полупроводников. Microsoft также использует существующее развертывание DPU AMD Pensando для интеграции этого оборудования в свои предложения Azure Boost с целью ускорения операций обработки сетевых данных и хранения.
Tom’s Hardware будет присутствовать на мероприятии AMD Advancing AI на этой неделе, где мы ожидаем узнать больше об амбициях AMD в области ИИ на вторую половину этого года и далее. Следите за нашими репортажами с этого мероприятия.

Facebook*, Instagram* и WhatsApp* принадлежат компании Meta* Platforms Inc., деятельность которой признана экстремистской и запрещена на территории Российской Федерации.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:

Похожие новости: