Ты собираешь GPU-сервер на 2027 год и видишь в анонсе Kioxia цифру 10 млн IOPS на один накопитель. В закупочную ведомость GP1 пока ставить рано: к концу 2026 года компания обещает лишь оценочные образцы для отдельных заказчиков, а параметры серийной версии могут измениться.
Решение зависит от срока запуска. Если сервер должен заработать в 2026 году, бери доступные NVMe и не привязывай проект к GP1. Если запуск назначен на 2027-й, а нагрузка упирается в мелкие чтения со стороны GPU, закладывай PCIe 6.0 и место под E3.S или E1.S — затем запрашивай образцы для испытаний.
За цифрой 10 млн IOPS скрывается узкий режим
В анонсе Kioxia, опубликованном StorageReview, указан максимум до 10 млн операций случайного чтения в секунду при размере блока 512 байт. Это не универсальная скорость накопителя.

Переведём IOPS в поток данных:
10 000 000 × 512 = 5 120 000 000 байт/с
Получается 5,12 ГБ/с без служебных расходов. Для сравнения накопителей одной этой цифры мало: мелкие запросы дают много операций, но каждый переносит лишь 512 байт.
Kioxia пока не раскрыла задержку, устойчивую скорость под долгой нагрузкой, смешанный профиль чтения и записи, ёмкость и потребляемую мощность в ваттах. Поэтому 10 млн IOPS нельзя переносить на обучение модели, виртуализацию или базу данных без замера на своём наборе запросов.
Если тебе нужен накопитель для файлового сервера, резервных копий или обычной базы, сначала сравни SSD, NVMe и HDD по характеру нагрузки. Рекорд GP1 получен не в этих сценариях.
GP1 должен стать быстрым слоем за памятью GPU
GP1 использует низколатентную память XL-FLASH второго поколения и рассчитан на прямой доступ со стороны GPU. По материалам анонса Kioxia, которые приводит StorageNewsletter, накопитель должен расширять дорогую HBM — память ускорителя — более дешёвым флеш-слоем.
Сценарий выглядит так: рабочий набор не помещается в HBM, но GPU обращается к нему часто и мелкими блоками. Обычный массив не успевает обслуживать нужное число запросов, а добавлять HBM дорого или невозможно. GP1 хранит менее горячую часть данных ближе к ускорителю.
Это ещё не доказывает, что GP1 ускорит твою модель. Результат зависит от задержки всего тракта: накопителя, контроллера PCIe, механизма прямого доступа и самого GPU. Если узел читает крупные последовательные блоки, заявленные 10 млн мелких операций могут не дать выигрыша.
Для общего пула данных архитектура будет другой. Там нужно отдельно решить, нужен ли локальный слой в каждом GPU-узле или общая All Flash СХД.
Платформу придётся выбрать раньше накопителя
GP1 рассчитан на PCIe 6.0 и NVMe 2.2. Заявлены три исполнения: E3.S, E1.S толщиной 9,5 мм и E1.S толщиной 15 мм. Все допускают воздушное охлаждение, а E3.S и тонкий E1.S — ещё и холодную пластину с жидкостным контуром.
Отсюда первое ограничение закупки: наличие свободного слота PCIe 6.0 ещё не означает, что сервер примет GP1. Нужны подходящие отсеки, объединительная плата, разводка линий PCIe и охлаждение под выбранный форм-фактор.
Платформа с PCIe 6.0 оставляет путь к GP1, но сам накопитель пока нельзя записать в обязательную часть поставки. Та же развилка возникает при переходе на серверы с AMD EPYC 9006: ждать новую платформу имеет смысл, только если её возможности нужны конкретной нагрузке и срок проекта позволяет ждать.
Количество GP1 считают по мелким чтениям
Возьмём пилотный GPU-узел, которому нужно 20 млн случайных чтений в секунду блоками по 512 байт. Допускаем, что серийный GP1 сохранит заявленные 10 млн IOPS и каждый запрос дойдёт до накопителя без потерь на файловой системе и программном стеке.
Теоретический минимум:
20 млн IOPS ÷ 10 млн IOPS = 2 накопителя
Для 40 млн IOPS понадобятся четыре. Общее правило:
количество GP1 = ceil(требуемые IOPS ÷ 10 млн)
Это нижняя граница, а не размер закупки. В ней нет запаса, резервирования и поправки на возможное снижение характеристик серийной версии.
При блоке 512 байт два накопителя дадут расчётный поток 10,24 ГБ/с. Если приложение читает блоками другого размера, смешивает чтение с записью или обращается через файловую систему, формула по заголовочным IOPS перестаёт работать. Тогда нужен образец и испытание полного тракта «накопитель — PCIe — GPU».
Спецификация под задачу
Считаем пилот для одного GPU-узла с требованием 20 млн случайных чтений в секунду блоками по 512 байт. Процессор, ускорители и память оставляем такими же, как в проектируемом рабочем узле: иначе испытание накопителей не покажет поведение будущей системы.
- Платформа: GPU-сервер с PCIe 6.0. Нужны линии шестого поколения до каждого испытываемого накопителя, а не только один слот на системной плате.
- Процессор и GPU: те же модели, число ядер и частоты, которые выбраны для рабочего узла. Анонс GP1 не даёт данных, по которым можно заново рассчитать вычислительную часть.
- Оперативная память: тот же объём и схема каналов, что в рабочем узле. Сокращённая память изменит кэширование и исказит результат испытания хранилища.
- Накопители: минимум два GP1 для расчётных 20 млн IOPS. Четыре — для 40 млн IOPS. Ёмкость пока не фиксируем: Kioxia её не объявила.
- Отсеки: E3.S либо E1.S толщиной 9,5 или 15 мм. До заказа шасси нужно выбрать одно исполнение и проверить совместимость корзины.
- Охлаждение: воздушное для любого заявленного исполнения; холодная пластина — только для E3.S и E1.S 9,5 мм.
- Сеть: по проекту рабочего узла. GP1 не задаёт пропускную способность сети, если данные остаются внутри сервера.
- Питание: два резервируемых блока с запасом под GPU и накопители. Их мощность можно назвать только после публикации энергопотребления GP1 и выбора ускорителей.
- Выносливость: до 50 DWPD, то есть до 50 полных перезаписей накопителя в день. Точное значение нужно сверить для выбранной ёмкости и исполнения серийной версии.
- Запас под рост: минимум два свободных совместимых отсека, если нагрузка может вырасти с 20 до 40 млн IOPS.
Компромисс здесь прямой. Платформа PCIe 6.0 и совместимое шасси обойдутся дороже доступного узла PCIe 5.0, зато позволят испытать GP1 без замены сервера. Экономия на платформе оправданна, если система должна войти в работу раньше появления серийных накопителей.
Что ставить в закупку
Для запуска до конца 2026 года не включай GP1 в обязательную спецификацию. Закажи доступное хранилище под подтверждённую нагрузку, а PCIe 6.0 и совместимые отсеки оставь опцией, если это не срывает бюджет и срок поставки.
Для проекта 2027 года запрашивай оценочные образцы, только если узел упирается в случайные чтения блоками около 512 байт. На испытании измерь задержку, устойчивые IOPS, смешанное чтение и запись, энергопотребление и поведение при прямом доступе GPU.
Правило приёмки простое: GP1 попадает в серийную ведомость после теста рабочего профиля, а не после сравнения заголовочных IOPS. До этого это перспективный компонент, но не готовая позиция для закупки.