В прошлом году OpenAI объявила о крупном партнерстве с Broadcom для развертывания 10 гигаватт пользовательских AI-ускорителей к 2029 году. В июне 2026 года OpenAI и Broadcom представили Jalapeño — первый собственный AI-чип для инференса, разработанный специально для больших языковых моделей и агентных нагрузок.
В то время OpenAI заявила, что Jalapeño обеспечит существенно лучшую производительность на ватт по сравнению с существующими ускорителями, но не опубликовала подробных цифр. Многие в индустрии скептически отнеслись к этим заявлениям, поскольку это первая попытка OpenAI спроектировать собственный чип, в то время как такие признанные игроки, как NVIDIA, Google и Amazon, имеют многолетний опыт разработки и развертывания нескольких поколений высокопроизводительных AI-чипов.
Сегодня OpenAI опубликовала первые результаты производительности Jalapeño, и на бумаге они выглядят впечатляюще. OpenAI протестировала Jalapeño с помощью публичного бенчмарка InferenceX от SemiAnalysis на моделях GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T. Согласно результатам, Jalapeño обеспечил в 1,5–1,9 раза больше AI-работы на ватт при пиковой пропускной способности и в 1,7–3,6 раза меньшую сквозную задержку по сравнению с эталонными системами на базе NVIDIA GB200 и GB300. Для высокоинтерактивных нагрузок OpenAI заявляет о преимуществе в производительности в 2,1–4,1 раза.
Например, при работе с DeepSeek R1 Jalapeño выдал 19 641 смешанных токенов в секунду на киловатт по сравнению с 11 781 у NVIDIA GB300. Сквозная задержка также снизилась с 5,99 секунды до 1,65 секунды. С Kimi K2.5 Jalapeño достиг примерно в 1,5 раза более высокой пиковой производительности на ватт и в 3,4 раза меньшей задержки.
Jalapeño также имеет номинальное энергопотребление всего 700 Вт, хотя OpenAI утверждает, что во время тестов устойчивое энергопотребление оставалось на уровне 550 Вт или ниже. Для сравнения, система GB300 имеет номинальное энергопотребление 1400 Вт. OpenAI подчеркнула, что чип разрабатывался совместно с памятью, сетевым оборудованием, программным обеспечением и стойко-масштабируемыми системами для минимизации перемещения данных.
Вновь OpenAI подчеркнула, что её AI-модели помогли спроектировать и запрограммировать чип. Чип Jalapeño прошёл путь от начального проектирования до выпуска фотошаблонов (tapeout) всего за девять месяцев. OpenAI планирует начать развёртывание Jalapeño в своей инфраструктуре к концу 2026 года. Чип второго поколения уже находится в глубокой разработке, а работы над третьим поколением также начались.
Несмотря на многообещающие результаты Jalapeño и будущие планы по выпуску собственных чипов, OpenAI заявляет, что продолжит развёртывать ускорители NVIDIA и других производителей как для обучения, так и для инференса, чтобы удовлетворить растущий спрос.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Pradeep Viswanathan




