20 июля AMD раскрыла полные характеристики своей стоечной ИИ-системы Helios, а также объявила о первом крупном клиенте — Microsoft начнёт разворачивать эти стойки в Azure во второй половине 2026 года. Компания впервые выходит на рынок не с отдельными ускорителями, а с полностью готовой стойкой, включающей собственные GPU, CPU, сетевые компоненты и стек ПО. Прямой конкурент — системы NVIDIA Vera Rubin NVL72.
В основе Helios — 72 ускорителя Instinct MI455X, процессоры EPYC 9006 (кодовое имя Venice, 2-нм техпроцесс TSMC, до 256 ядер и 512 потоков на сокет) и сетевые DPU Pensando. Всё работает с жидкостным охлаждением в открытом формате OCP.
Конфигурация включает 18 вычислительных узлов с четырьмя GPU и одним CPU на каждом. Вес стойки — около трёх тонн, потребление — до 245 кВт, ориентировочная цена — 5,5 млн долларов (по оценке CNBC).
Характеристики каждого MI455X: 432 ГБ памяти HBM4 с пропускной способностью 19,6 ТБ/с. В сумме на стойку — 31 ТБ HBM4, до 2,9 эксафлопс в FP4 и 1,4 эксафлопс в FP8.
Внутристоечная пропускная способность — 260 ТБ/с, межстоечная — 43 ТБ/с через UALink over Ethernet.
Стековое ПО: ROCm, валидированный под PyTorch, TensorFlow, JAX, vLLM и DeepSpeed.
Сравнение с прошлым поколением
Предшественником можно считать семейство MI350X, но AMD не поставляла его в виде готовых стоек. У MI350X было 288 ГБ HBM3e и 8 ТБ/с пропускной способности. MI455X предлагает в полтора раза больше памяти (432 ГБ), которая работает почти в 2,5 раза быстрее (19,6 ТБ/с). Производительность в FP4 выросла с 20 до 40 петафлопс на GPU, в FP8 — с 5 до 20 петафлопс.
Конкуренция с NVIDIA и Huawei
Прямой соперник Helios — Vera Rubin NVL72. По чистым флопсам впереди NVIDIA (50 PF FP4 против 40 у MI455X), но по памяти выигрывает AMD: 432 ГБ против 288 ГБ на ускоритель, и 31 ТБ против 20,7 ТБ в пересчёте на стойку. Для инференса крупных моделей с длинным контекстом объём памяти часто важнее пиковой вычислительной мощности.
Интерконнект внутри стойки одинаков (260 ТБ/с), а межстоечный — AMD заявляет примерно в полтора раза больше благодаря UALink over Ethernet. Однако это теоретические данные, практика покажет.
Идеологически подходы различаются: NVIDIA опирается на проприетарные NVLink и CUDA, AMD — на открытые стандарты (UALink, Ultra Ethernet, OCP, ROCm). С одной стороны, это снижает зависимость от вендора, с другой — может означать, что интеграцию придётся «допиливать» самостоятельно.
Третий игрок — Huawei с системой CloudMatrix 384 на ускорителях Ascend 910C и собственном стеке CANN. Из-за экспортных ограничений эти решения почти не пересекаются на рынке: Huawei не поставляет западным облакам, AMD официально не возит топовые Instinct в Китай.
Значение для рынка
Контракт с Microsoft — первая победа стоечного AMD среди гиперскейлеров. Провайдер планирует использовать Helios для виртуальных машин под продакшн-инференс, а также добавить инстансы на новых EPYC для агентных ИИ и проектирования микросхем. В списке ранних клиентов заявлены и другие крупные компании.
Важно, что AMD впервые предлагает полный стек — GPU, CPU, сеть и софт — как единое решение. До сих пор в сегменте готовых ИИ-стоек фактически доминировала NVIDIA.
Впрочем, скепсис уместен: финансовые условия и объёмы развёртывания не раскрыты, ROCm ещё нужно довести до ожидаемого гиперскейлерами уровня, а цены и даты общей доступности не объявлены. Пока это заявление о намерениях, а не запуск продукта. Первые поставки Helios в дата-центры запланированы на вторую половину 2026 года — тогда станет ясно, насколько успешно AMD воплотит планы в жизнь.
Источник: https://selectel.ru/blog/amd-helios/