AMD Instinct MI455X и Helios: что меняется в конкуренции с Nvidia

AMD раскрыла Instinct MI455X и стойку Helios на 72 GPU. Смотрим на память HBM4, архитектуру CDNA 5 и то, что ещё не подтверждено независимыми тестами.

Ускоритель AMD Instinct MI455X и стоечная система Helios для ИИ

По состоянию на 24 июля 2026 года AMD Instinct MI455X — новый ускоритель для обучения и инференса ИИ на архитектуре CDNA 5 с 432 ГБ памяти HBM4. Стоечная платформа Helios объединяет 72 таких GPU, но опубликованные показатели пока остаются в основном паспортными: независимого сравнения Helios и Nvidia Vera Rubin на одинаковой нагрузке нет.

Анонс важен не из-за ещё одной большой цифры в таблице. AMD впервые выводит Instinct на тот же стоечный масштаб, где Nvidia уже продаёт системы NVL72. Теперь спор идёт не только о GPU, но и о памяти, межсоединении, процессорах, сети и программном стеке всей стойки.

MI455X получил 432 ГБ HBM4 и архитектуру CDNA 5

AMD представила Instinct MI455X 23 июля 2026 года. В официальной спецификации указаны 320 млрд транзисторов, вычислительные кристаллы по техпроцессу TSMC 2 нм, кристаллы ввода-вывода 3 нм и 256 рабочих групп процессоров. Ускоритель рассчитан на обучение, дообучение и инференс крупных моделей.

Самая заметная характеристика — 432 ГБ HBM4 в 12 стеках. Пиковая пропускная способность памяти достигает 23,3 ТБ/с. Для низкой точности AMD заявляет до 40,3 петафлопса OCP MXFP4 и 20,1 петафлопса OCP MXFP8 на один ускоритель.

Модуль AMD Instinct MI455X с логотипом Instinct
AMD Instinct MI455X построен на архитектуре CDNA 5 и оснащён 432 ГБ HBM4. Источник: AMD.

Все эти значения описывают теоретический максимум железа. Они не показывают скорость выдачи токенов, задержку, энергопотребление или масштабирование конкретной модели. Tom’s Hardware отдельно предупреждает, что реальная производительность будет ниже пиковых значений и сильно зависит от программной оптимизации.

У самой AMD пока есть несогласованность в карточках продукта. Основная спецификация MI455X и верхний блок страницы Helios указывают 23,3 ТБ/с, а в одном из нижних описаний Helios всё ещё стоит 19,6 ТБ/с. В статье используется значение 23,3 ТБ/с из отдельной актуальной спецификации MI455X, проверенной 24 июля.

Helios связывает 72 GPU в одну стоечную систему

Helios состоит из 18 вычислительных лотков по четыре MI455X и шести сетевых лотков. В стойку также входят процессоры AMD EPYC Venice, сетевые адаптеры Pensando Vulcano и программная платформа ROCm. Совокупный объём HBM4 составляет около 31 ТБ, а расчётная пропускная способность памяти всей стойки — до 1,67 ПБ/с.

Внутри стойки AMD использует UALink over Ethernet, или UALoE. Официальная схема обещает полносвязное соединение всех 72 GPU и до 260 ТБ/с суммарной двунаправленной пропускной способности на уровне scale-up. Tom’s Hardware описывает Helios как первый для AMD единый когерентный домен на 72 ускорителя.

Задняя часть стойки AMD Helios с кабелями и жидкостным охлаждением
Вид сзади на Helios: полносвязная сеть GPU, питание и жидкостное охлаждение собраны в одной стоечной конструкции. Источник: AMD.

Размер домена важен для моделей с распределёнными экспертами и большими KV-кэшами: меньше данных приходится гонять через более медленную сеть между стойками. Однако 72 связанных GPU не превращаются автоматически в один ускоритель без накладных расходов. Итог зависит от коллективных операций, планировщика, библиотек ROCm и того, насколько хорошо конкретная модель использует топологию.

Сравнение MI455X и Rubin пока ограничено паспортными данными

ПараметрAMD MI455X / HeliosNvidia Rubin / NVL72ИсточникСтатус доказательства
HBM4 на один GPU432 ГБ288 ГБСпецификации AMD и NvidiaПаспортные данные
Пиковая пропускная способность HBM423,3 ТБ/с22 ТБ/сСпецификации AMD и NvidiaПаспортные данные
GPU в стоечном домене7272Страницы Helios и Vera RubinАрхитектура систем
Совокупная HBM4Около 31 ТБОколо 20,7 ТБAMD; расчёт 72 × 288 ГБ для NvidiaПаспортные данные и расчёт
Пиковая низкоточная производительность40,3 PFLOPS OCP MXFP4До 50 PFLOPS NVFP4 для инференса; 35 PFLOPS для обученияСпецификации AMD и NvidiaФорматы и режимы различаются; прямой рейтинг некорректен
ДоступностьМассовые развёртывания ожидаются во втором полугодии 2026 годаВ июле 2026 года Nvidia сообщала о наращивании производства и работающих стойках у партнёровAMD и NvidiaПланы вендоров, не независимый аудит поставок

У AMD больше памяти на GPU и немного выше заявленная пропускная способность HBM4. У Nvidia уже есть работающие Vera Rubin NVL72 у CoreWeave, Google Cloud, Microsoft Azure и Oracle. CoreWeave опубликовала замер DeepSeek-R1 на живом оборудовании, но сравнивала Rubin с предыдущим поколением Nvidia Grace Blackwell, а не с Helios.

Пиковые FLOPS в OCP MXFP4 и NVFP4 нельзя ставить в один честный рейтинг без одинаковой точности, разреженности, модели, мощности стойки и версии ПО. Поэтому формулировка «MI455X быстрее Rubin» сейчас была бы преждевременной. Мы уже разбирали, как Nvidia превратила Blackwell в стоечную платформу GB200 NVL72; Helios повторяет этот системный подход, но делает ставку на открытые межсоединения и большую память.

Microsoft и Anthropic подтверждают спрос, а не лидерство

Microsoft 20 июля объявила, что добавит Helios в Azure. На платформе появятся виртуальные машины ND MI455X v7 для крупномасштабного инференса. Срок публичной доступности и цены Microsoft пока не назвала.

AMD и Anthropic также договорились о развёртывании до 2 ГВт ускорителей серии MI450 в системах Helios. Первый гигаватт планируется запустить в первой половине 2027 года. Это сильный сигнал спроса, но он не доказывает цену токена, стабильность ROCm или преимущество над Nvidia на производственных нагрузках.

Сделки показывают, зачем AMD понадобилась полноценная стойка: крупные лаборатории покупают не отдельные чипы, а готовые блоки мощности, сети и охлаждения. В отдельном материале мы подробно разбирали, как OpenAI и Anthropic наращивают вычислительные мощности и инфраструктурные бюджеты.

Что ещё должна доказать AMD

Helios уже выглядит прямым ответом на NVL72 по форме продукта: 72 GPU, единая сеть scale-up, собственные CPU, сетевые контроллеры и жидкостное охлаждение. Но для оценки системы не хватает четырёх групп публичных данных:

  • результатов одной и той же модели на Helios и Vera Rubin с одинаковыми настройками качества;
  • токенов в секунду на GPU, стойку и мегаватт;
  • полной стоимости владения с учётом питания, охлаждения и сети;
  • стабильности ROCm и эффективности масштабирования при работе всех 72 ускорителей.

AMD Instinct MI455X делает конкуренцию в ИИ-инфраструктуре заметно предметнее: у AMD теперь есть не только мощный ускоритель, но и цельная стоечная архитектура. Реального победителя определят поставки и независимые тесты, а не максимумы в презентациях.

Источники и дата проверки

Характеристики, даты и планы развёртывания проверены 24 июля 2026 года:

Читайте также

Telegram-канал @toolarium