В заявку на новый ИИ-сервер уже просят включить Intel Crescent Island. На бумаге карта подходит для узла с воздушным охлаждением: PCIe, 350 Вт и 160 ГБ памяти в фирменной версии.
Вывод для закупки простой: добавь Crescent Island в список кандидатов для инференса, но не фиксируй её обязательной позицией до коммерческого предложения и испытаний. Характеристики архитектуры ещё не показывают итоговую конфигурацию узла и производительность на твоей модели.
Crescent Island рассчитана прежде всего на инференс
Intel представила Crescent Island на Hot Chips 2026 как ускоритель для инференса, в том числе агентных моделей. По материалам Intel, карта получила архитектуру Xe3P, 32 ядра Xe и 256 матричных движков XMX.

Ускоритель поддерживает вычисления от FP4 и MXFP4 до FP64. Квантованная модель может использовать короткое представление чисел, а задачи с повышенными требованиями к точности — FP32 или FP64. Сам перечень форматов не показывает скорость модели: для сравнения нужны замеры с одинаковой длиной контекста, размером пакета и числом одновременных запросов.
Позиционирование Crescent Island отличается от Nvidia Rubin и AMD MI455X. В разборе Tom’s Hardware Rubin и MI455X описаны как ускорители для обучения и инференса с HBM4 и жидкостным охлаждением. Intel делает ставку на инференс при воздушном охлаждении и мощности 350 Вт.
Это не замена Rubin или MI455X один к одному. Crescent Island интересна там, где модель помещается в память одной карты, а стойка не рассчитана на жидкостный контур.
160 ГБ можно учитывать, 480 ГБ — пока нельзя
Фирменная карта Intel получит 160 ГБ LPDDR5X. Архитектура допускает до 480 ГБ, но такие карты смогут выпускать ODM-партнёры в собственном исполнении. Это разделение приводит ServeTheHome в отчёте с доклада Intel на Hot Chips 2026.
В заявку нельзя переносить фразу «до 480 ГБ» как характеристику любой Crescent Island. Верхний предел архитектуры не описывает конкретную карту партнёра, её охлаждение и совместимость с выбранным сервером. Для расчёта фирменной версии бери 160 ГБ.
Intel утверждает, что на одной такой карте помещаются FP8-веса модели вместе с KV-кэшем — памятью для промежуточных данных текущих запросов. В заявлении не указаны размер модели, длина контекста и число параллельных сессий. Поэтому 160 ГБ отвечают на вопрос «поместится ли нагрузка», но не на вопрос «сколько запросов она обработает за секунду».
Если ты только собираешь архитектуру узла, сначала определи место ускорителя в сервере для ИИ и машинного обучения. Одна большая модель, несколько независимых моделей и несколько реплик одной модели требуют разной разводки PCIe и памяти.
Две карты требуют отвести 700 Вт только на ускорители
Crescent Island подключается по PCIe Gen5 x16, потребляет до 350 Вт и охлаждается воздухом. Для двух карт нужны два полноскоростных слота и линии PCIe без перехода на x8:
2 × 350 Вт = 700 Вт
Для четырёх карт:
4 × 350 Вт = 1400 Вт
Это мощность только ускорителей. Процессоры, память, накопители, сетевые платы, вентиляторы и потери блоков питания идут сверху. Итоговый номинал БП зависит от всей конфигурации хоста.
Тепловая нагрузка остаётся той же. Узел с четырьмя картами должен отвести 1400 Вт от ускорителей воздушным потоком, не считая остальных компонентов. Воздушное охлаждение карты ещё не означает, что она подойдёт к любому корпусу с четырьмя PCIe-слотами.
До заказа проверь у интегратора три вещи: сколько слотов занимает выбранная версия карты, какую мощность допускает каждый слот и выдерживает ли корпус заданное число ускорителей при допустимой температуре входящего воздуха.
Для сравнения корпусов и разводки слотов пригодится отдельный разбор серверов с GPU для ИИ и Big Data. Модель ускорителя — только половина выбора. Вторая половина — хост, который питает карты и сохраняет ширину PCIe при установке соседних устройств.
Заявленный программный стек сокращает объём миграции
Для Crescent Island заявлена поддержка vLLM, SGLang, llm-d и NVIDIA Dynamo. Ниже по стеку Intel перечисляет Triton, SYCL-TLA, oneCCL, oneDNN, SYCL, Level Zero и OpenCL.
С таким набором можно начать проверку на существующем контуре инференса. Но название фреймворка в презентации не гарантирует, что твоя модель запустится без замены операторов, другой квантизации или собственной сборки библиотек.
Нужен испытательный прогон. Возьми ту же модель, формат весов, длину контекста и число одновременных запросов, которые работают в продакшене. Сравни задержку первого токена, скорость генерации, потребление памяти и мощность всего узла с доступной альтернативой. Цифры из испытаний с разной методикой для такого выбора бесполезны.
Intel также заявляет ECC и parity для памяти, проверку ошибок на внутренних переходах, динамическое отключение сбойных страниц, восстановление после упаковки кристалла и PCIe AER. Эти механизмы помогают обнаруживать и локализовать аппаратные ошибки. Требования к доступности узла всё равно придётся проверять на конкретном сервере, драйверах и рабочей нагрузке.
Спецификация под задачу: опытный узел с двумя картами
Считаем узел для инференса двух реплик модели. Допущение: каждая реплика вместе с KV-кэшем укладывается в 160 ГБ одной Crescent Island. Одну карту или одну реплику можно остановить, не прерывая вторую.
- Ускорители: две Crescent Island по 160 ГБ и 350 Вт. Каждая реплика получает отдельную карту; суммарный лимит ускорителей — 700 Вт.
- PCIe: два слота PCIe Gen5 x16 с 32 выделенными линиями. Если сетевой адаптер или NVMe отнимают линии и переводят слот в x8, такой хост не подходит для сравнительного испытания.
- Оперативная память: 512 ГБ ECC RDIMM. Два образа весов по 160 ГБ требуют 320 ГБ. Добавляем 20% на загрузку, перекодирование и служебные процессы:
2 × 160 × 1,2 = 384 ГБ. Ближайший объём с запасом — 512 ГБ. Если хост не держит обе копии весов одновременно, память можно сократить после замера загрузки. - Накопители: два NVMe по 3,84 ТБ в RAID 1. Два образа по 160 ГБ займут 320 ГБ; остальной объём останется под версии моделей, кэш контейнеров, журналы и повторные испытания. RAID 1 сохраняет узел при отказе одного накопителя, но не заменяет внешнее хранилище моделей.
- Сеть: два порта 100 Гбит/с. Чтобы передать образ 160 ГБ за 30 секунд, нужна полезная скорость около
160 × 8 / 30 = 42,7 Гбит/с. Один порт 100 Гбит/с покрывает расчёт с запасом на протокольные потери. Второй можно отдать под служебный трафик или резервный путь. - Питание: два резервирующих друг друга блока. Их мощность интегратор рассчитает для выбранных процессоров, вентиляторов и ускорителей. Нижняя граница нагрузки уже известна — 700 Вт на две карты, но итоговый номинал зависит от всего узла.
- Корпус: стоечный GPU-сервер с двумя полноскоростными слотами и подтверждённой поддержкой двух воздушных карт по 350 Вт. Высоту и глубину корпуса выбирай под конкретную версию карты и матрицу совместимости производителя сервера.
Это спецификация испытательного узла, а не готовый заказ. Её слабое место — зависимость от исполнения конкретной карты и совместимости с хостом. Сначала интегратор подтверждает сочетание карты, шасси и блоков питания, затем эта комбинация попадает в заявку.
Если модели вместе с рабочим KV-кэшем нужно больше 160 ГБ, не добавляй вторую карту автоматически. Перенос данных между ускорителями зависит от пропускной способности межсоединения и поддержки в программном стеке. Проверяй многокарточный режим на опытном узле либо рассматривай конкретную ODM-версию на 480 ГБ после публикации её характеристик.
Когда Crescent Island можно вносить в закупку
Для ближайшего цикла закупки выбирай платформу, на которую поставщик уже готов дать коммерческое предложение и подтвердить совместимость компонентов. Crescent Island оставь альтернативой, если 160 ГБ на одной карте сокращают число ускорителей, а воздушное охлаждение подходит твоей площадке.
Перенести её из списка кандидатов в спецификацию можно после четырёх подтверждений:
- поставщик назвал коммерческую модель, цену и срок поставки;
- известны размеры выбранной карты, разъёмы питания и требования к воздушному потоку;
- производитель сервера или интегратор подтвердил совместимость с конкретным шасси;
- опытный узел прошёл замер на твоей модели, длине контекста и числе параллельных запросов.
Если эти данные появятся до размещения заказа, сравни Crescent Island с доступным ускорителем по одной методике. Если сервер нужен раньше, не строй проект вокруг позиции без подтверждённой поставки. Для нагрузки больше 160 ГБ на один ускоритель считай только параметры конкретной ODM-карты: предел архитектуры в 480 ГБ сам по себе ещё не годится для закупочной спецификации.