Новости

Marvell Structera S: ждать PCIe 6.0 или закупать GPU-сервер сейчас

Дмитрий Потоцкий 1 мин чтения
Marvell Structera S: ждать PCIe 6.0 или закупать GPU-сервер сейчас

Marvell анонсировала Structera S 60260 и S 30260 17 марта 2026 года. Инженерные образцы уже существуют, но клиентские образцы появятся лишь в III квартале. Готовых серийных серверов с этими коммутаторами Marvell пока не назвала.

Если ты закупаешь один сервер или небольшой GPU-узел, откладывать проект не стоит. Бери доступную платформу PCIe 5.0. Structera рассчитана на другую нагрузку: стойку с 16–32 процессорами и ускорителями, которым нужен общий пул памяти до 48 ТБ.

Structera объединяет память на уровне стойки

Под одним названием Marvell выпустила два коммутатора с разными задачами.

Техник осматривает серверные стойки

Structera S 60260 обслуживает PCIe 6.0 и предоставляет 260 линий. Через него CPU, GPU, SSD и другие устройства обмениваются данными внутри крупной вычислительной системы.

Structera S 30260 работает с CXL 3.0. Он подключает 16 или 32 CPU и GPU к общему пулу памяти объёмом до 48 ТБ. Память можно распределять между вычислительными устройствами, а не закреплять за одним сервером.

По описанию семейства Structera от Marvell, S 30260 обеспечивает совокупную полосу до 4 ТБ/с, а полный обмен занимает менее 460 нс. Коммутатор поддерживает DDR4 и DDR5.

Такая архитектура нужна не каждому серверу с GPU. Она оправдана, когда ускорителям не хватает локальной памяти и нагрузку нельзя разложить по независимым узлам.

Выгода появляется на инференсе с большим KV-кэшем

Типовой сценарий для Structera S 30260 — несколько GPU обслуживают модель с длинным контекстом. KV-кэш растёт вместе с контекстом и числом одновременных запросов. Если он не помещается в локальную память ускорителей, приходится сокращать пакет, выгружать данные или распределять их по сети.

Кабели между рядами стоек

Общий пул CXL меняет схему: GPU получают доступ к памяти за пределами своего сервера, а платформа перераспределяет объём между узлами. Один ускоритель может занять больше памяти во время пика, не оставляя этот объём закреплённым за собой постоянно.

Marvell сообщает о росте пропускной способности инференса до 4,8 раза, сокращении времени до первого токена на 82,7% и задержке на 72% ниже, чем у пулинга через RDMA. Это результаты тестов производителя, а не прогноз для любой стойки. Marvell не раскрывает в опубликованном описании состав моделей, число одновременных запросов, конфигурацию GPU и параметры RDMA-системы, достаточные для прямого расчёта твоей нагрузки.

Поэтому в заявку нельзя переносить «4,8 раза» как ожидаемый результат. Запрашивай тест на своей модели, длине контекста, размере пакета и целевом числе запросов в секунду.

PCIe 6.0 потребует проектировать стойку целиком

Structera S не ставят в существующий сервер как обычную плату расширения. Коммутатор входит в связку из нескольких компонентов:

  • Structera X подключает дополнительную память;
  • Structera A обрабатывает данные рядом с памятью;
  • Alaska P восстанавливает сигнал на длинных соединениях;
  • Structera S связывает CPU, GPU, XPU, память и накопители.

С коммутатором Structera S и ретаймерами Alaska P линия PCIe 6.0 может пройти по активному электрическому кабелю до 7 м. Для расстояний свыше 7 м Marvell предусматривает активную оптику. Это уже влияет на размещение стоек, кабельные трассы и состав оборудования.

Marvell заявляет проверенную совместимость семейства CXL с Intel Xeon, AMD EPYC и Arm, а также работу с Micron, Samsung и SK Hynix над квалификацией памяти. Но совместимость компонентов ещё не означает, что поставщик привезёт готовый сервер нужной конфигурации и возьмёт его на поддержку.

До заказа нужны название OEM-платформы, перечень квалифицированных модулей, топология соединений и срок поставки. Без этих данных запись «CXL 3.0, PCIe 6.0» описывает интерфейс, но не товар.

Три решения для закупки в 2026 году

Закупай доступную PCIe 5.0-платформу, если проект запускается до III квартала, а вся рабочая модель помещается в локальную память одного или нескольких GPU. Коммутаторы Structera PCIe 5.0 уже поставляются; S 60260 и S 30260 пока находятся на стадии образцов.

Для одного сервера или небольшого узла разумнее вложить бюджет в достаточный объём памяти GPU, питание и охлаждение. Новый межсоединитель не компенсирует нехватку локальной памяти и не ускорит нагрузку, которая упирается в вычислительные блоки ускорителя.

Предусмотри миграцию, если сейчас нужен один узел, а затем контур вырастет до нескольких серверов. S 60260 выполнен pin-совместимым с CXL-версией Structera S. Это может сократить переделку платы, но не гарантирует замену коммутатора в готовом сервере: такую возможность должен подтвердить OEM.

Ждать клиентских образцов стоит для проекта на 16–32 CPU и GPU с общим пулом памяти. Причём III квартал 2026 года — дата начала передачи образцов заказчикам, а не серийных поставок. После неё ещё предстоит проверить прошивки, память, кабели, производительность и поддержку OEM.

Если выбор завязан не только на коммутатор, но и на новое поколение CPU, сравни сроки с выходом серверов на AMD EPYC Venice. Ожидание имеет смысл, когда обе части платформы попадут в доступную OEM-систему одновременно.

Спецификация под задачу

Для пилота берём сценарий, который укладывается в заявленную архитектуру Marvell: 16 вычислительных устройств, общий пул памяти 48 ТБ и инференс, ограниченный объёмом KV-кэша. Делим 48 ТБ поровну — получаем до 3 ТБ общей памяти на одно устройство при равномерной нагрузке. При динамическом распределении отдельный узел сможет занять больше, если соседним узлам в этот момент память не нужна.

В запросе поставщику укажи такую конфигурацию:

Узел спецификацииТребованиеЗачем оно нужно
Вычислительный контур16 CPU и GPU с возможностью расширения до 32Это две топологии, которые Marvell заявляет для S 30260
Коммутатор памятиStructera S 30260, 260 линий, CXL 3.0Он подключает вычислительные устройства к общему пулу
Общая память48 ТБ DDR5 либо квалифицированная смешанная схема DDR4/DDR5Такой верхний объём указан для S 30260
Совокупная полосадо 4 ТБ/с с результатом замера на целевой конфигурацииПаспортный предел нужно проверить на выбранной топологии
Задержкаменее 460 нс round trip по методике Marvell либо согласованному тесту OEMБез методики цифры разных поставщиков нельзя сравнивать
Расширение памятиКонтроллеры Structera X из перечня OEMS 30260 работает с ними как часть общей архитектуры
МежсоединенияAlaska P, AEC до 7 м; AOC для большей длиныТип кабеля зависит от расстояния между устройствами
СовместимостьКонкретная платформа Intel Xeon, AMD EPYC или Arm в матрице OEMОбщая совместимость семейства не заменяет квалификацию сервера
ПриёмкаТест целевой модели, длины контекста, пакета и числа параллельных запросовТак проверяется выигрыш именно на твоём инференсе
ПоставкаДата клиентского образца и отдельная дата серийной системыMarvell обещает образцы с III квартала, не серийный сервер

Процессор, модель GPU, накопители, блоки питания и форм-фактор здесь нельзя назначить честно: в исходных данных нет требуемой модели, мощности ускорителей и объёма рабочего набора. Эти строки поставщик должен заполнить для названной OEM-системы, а затем подтвердить расчётом питания, охлаждения и числом доступных CXL-линий.

Компромисс у пилота прямой. Ты получаешь память, которую можно перераспределять между ускорителями, но зависишь от ещё не выпущенной серийно связки коммутатора, модулей, кабелей и прошивок. PCIe 5.0 доступна сейчас, зато не даёт общего пула на 48 ТБ с параметрами S 30260.

Что вписать в заявку поставщику

Не ставь отдельное требование «поддержка CXL 3.0 и PCIe 6.0». Оно не отвечает ни на вопрос о производительности, ни на вопрос о поставке.

Запрос должен фиксировать шесть вещей: число CPU и GPU, объём общей памяти, топологию соединений, проверенную полосу, задержку по названной методике и перечень квалифицированных модулей. Отдельной строкой потребуй дату серийной поставки OEM-системы.

Если у тебя до нескольких GPU и модели помещаются в их память, закупай доступную платформу. Если проект вырастет позже, требуй от OEM подтверждённый путь миграции. Пилот Structera нужен тогда, когда контур уже рассчитан на 16–32 вычислительных устройства, а дефицит памяти измеримо ограничивает инференс.