Новости: инференс
Rubin CPX от NVIDIA исключен из дорожной карты: место заняли LPU от Groq для инференса, но возвращение возможно с Feynman в 2028 году
Чип Rubin CPX от NVIDIA неожиданно не был показан на GTC. Согласно новому обновлению, решение «отложено» и перенесено на эпоху Feynman. NVIDIA смещает фокус с Rubin CPX на LPX с LPU от Groq для инференса. — wccftech.com

Nvidia планирует создание ИИ-сетей вместе с операторами и партнерами
Nvidia начала ухаживание за операторами связи с AI-RAN. Теперь она расширила свое предложение архитектурой AI grid. Ее тестируют AT&T, Comcast, Charter Communications, T-Mobile US и индонезийская IOH. Технологические партнеры, включая Cisco и HPE, также участвуют. — telecomtv.com

Изгнание NVIDIA из Китая может закончиться: H200 возвращается в строй, а решение на базе Groq выходит на рынок
Глава NVIDIA сообщил о прорыве в бизнесе в Китае и подготовке к запуску решения Groq. Производство H200 возобновлено, Дженсен Хуанг уверен в одобрении. Регуляторные барьеры вынуждали NVIDIA менять планы, но теперь H200 возвращается. — wccftech.com

NVIDIA ожидает взрывной рост выручки от вычислительного оборудования до 1 триллиона долларов за два года на фоне «инфлекционной точки» ИИ в сфере инференса
Глава NVIDIA Дженсен Хуанг озвучил шокирующий прогноз по росту спроса на вычислительные мощности. Мир ИИ спровоцировал «дикий» спрос на вычисления из-за инференса, и NVIDIA готова извлечь выгоду. Прогноз выручки превысил $1 трлн на 2025–2027 гг. — wccftech.com

NVIDIA представляет Vera Rubin с «LPX» от Groq для прорыва в сегмент «inference», где компания никогда не была лидером
Официальное оформление партнерства NVIDIA и Groq: Дженсен Хуанг представил гибридный лоток Vera Rubin с блоками LPU Groq3. NVIDIA нацеливается на высокоскоростные нагрузки инференса, стремясь обойти конкурентов. — wccftech.com

Стойки Nvidia, Groq 3 LPU и Groq LPX пополнили платформу Rubin на конференции GTC
На GTC 2026 Nvidia представила ускоритель Groq 3 и стойку Groq LPX как часть платформы Vera Rubin. Эти чипы, ориентированные на инференс и насыщенные SRAM, обеспечивают большую пропускную способность памяти, чтобы помочь Rubin обеспечить низколатентное взаимодействие с моделями ИИ, охватывающими триллионы параметров и контексты в миллионы токенов. — tomshardware.com

Самое просматриваемое:
- Вот как использовать новую кнопку “Плюс”…
- Bitcoin Depot оштрафован на $18,5 млн – сталкивается…
- WatchGuard бьёт тревогу: критическая уязвимость…
- Как настроить ComfyUI для генерации изображений ИИ…
- ECARX берет управление бизнесом Flyme OS в свои руки…
- Результаты еженедельного опроса: Samsung Galaxy Z…
- США прикрыли платформу для хранения паролей, которой…
- Исследователи из MIT возродили 40-летнюю концепцию…
- Представитель сервисного центра Google сообщил…
- Тим Суини из Epic: «нечестность» и «грубое…



