NVIDIA

Серверные GPU: от T4 в свободный слот до эпохи Blackwell

NVIDIA пришла к статусу самой дорогой компании мира на серверных ускорителях: в июле 2025 года её капитализация первой в истории перешагнула 4 триллиона долларов, в октябре — 5 триллионов. Выручка за финансовый 2026 год — 215,9 млрд долларов, и подавляющая её часть — не игровые видеокарты, а вычисления и сети для ЦОД.

Фундамент заложен ещё в 2007 году, когда вышла CUDA — закрытая платформа вычислений на GPU. За полтора десятилетия вокруг неё выросла вся индустрия глубокого обучения: компиляторы, библиотеки, готовые инструменты. Следствие для покупателя простое: почти любой софт для нейросетей, перекодирования видео и научных расчётов из коробки ожидает карту NVIDIA. Альтернативы от AMD и Intel существуют, но по зрелости экосистемы отстают — за NVIDIA больше 80% рынка GPU для обучения и запуска ИИ-моделей.

Для системного администратора в России эта история выглядит приземлённее. Флагманы H100 и Blackwell в РФ официально не поставляются — с августа 2022 года на них действует экспортное лицензионное требование США, а спрос в мире таков, что производство Blackwell на весь 2025 год было распродано ещё в ноябре 2024-го. Зато массовые серверные карты прошлых поколений — T4, V100, P40 — обращаются на вторичном рынке. Именно они закрывают реальные задачи: виртуальные рабочие столы, запуск обученных нейросетей, обработку видео.

Server360 помогает подобрать ускоритель под конкретное шасси: проверяем совместимость по питанию, охлаждению и драйверам, тестируем карту перед отгрузкой. Поставки — под заказ. Гарантию даёт продавец: вендорской поддержки NVIDIA в РФ нет с 2022 года.

О бренде

Что нужно знать о NVIDIA

Карта поколений: что реально купить и зачем

До мая 2020 года серверные ускорители NVIDIA назывались Tesla. От имени отказались из-за путаницы с автомобильной маркой — официально теперь это NVIDIA Data Center GPU, но на вторичном рынке карты так и продаются под старыми названиями: Tesla P40, Tesla V100.

Рабочие лошадки вторички. Три карты закрывают большинство задач. T4 (Turing, 2018) — 16 ГБ GDDR6 при 70 Вт: низкопрофильная, однослотовая, питается от слота PCIe без дополнительных кабелей — встаёт в стандартный 1U/2U-сервер без переделок. Её стихия — запуск обученных нейросетей (инференс), перекодирование видео, виртуальные рабочие столы. V100 (Volta, 2017) — 16 или 32 ГБ HBM2, первый ускоритель с тензорными ядрами, несколько лет был отраслевым стандартом обучения нейросетей. P40 (Pascal, 2016) — 24 ГБ GDDR5, 250 Вт; по отзывам сообщества локальных языковых моделей, самый дешёвый способ получить 24 ГБ видеопамяти (на мировом рынке — порядка 150–200 долларов), расплата — слабый FP16 и хлопоты с охлаждением и питанием. K80 брать уже почти бессмысленно — драйверы для Kepler закончились; M60 — только под старый софт, который не будет обновляться.

Для VDI. Поколение Ampere принесло специализированные карты: компактную A2 (16 ГБ) и A16 — четыре GPU по 16 ГБ на одной плате специально под виртуальные рабочие столы. Для тяжёлой графики в ВМ есть A40 с 48 ГБ.

Текущие универсалы. L4 (24 ГБ, 72 Вт) — прямая наследница T4 в том же формате «в любой сервер». L40S (48 ГБ GDDR6, 350 Вт, два слота) — карта «на всё сразу»: нейросети, графика, рендеринг.

Флагманы — отдельный мир. A100, H100 (80 ГБ HBM3, до 700 Вт), H200 и поколение Blackwell в Россию официально не поставляются — на них действует экспортный контроль США, подробнее ниже. И один нюанс на будущее: флагманы выпускаются в двух форм-факторах — PCIe-карта и SXM-модуль. SXM ставится только в специализированные платы HGX/DGX; для обычного сервера он бесполезен, какой бы привлекательной ни была цена.

Установка в сервер: три вещи, которые сжигают деньги

Пассивным картам нужен обдув

У P40, V100 и T4 нет собственных вентиляторов. Это не экономия, а расчёт на сквозной поток воздуха серверного шасси. В корпусе без направленного обдува карта перегреется — сначала сбросит частоты, потом откажет. Перед покупкой убедитесь, что сервер поддерживает GPU-конфигурацию: нужный набор вентиляторов, воздуховод.

Разъём питания: EPS-12V, а не PCIe

Главная ловушка для новичка. Карты Tesla с дополнительным питанием — K80, M40/M60, P40, P100, V100 PCIe — берут питание через 8-контактный разъём CPU (EPS-12V). Внешне он почти неотличим от PCIe 8-pin, но распиновка другая. В сообществе r/homelab и на форуме NVIDIA это дежурное предупреждение: подключите обычный PCIe-кабель — рискуете сжечь карту или блок питания. Нужен правильный кабель или переходник, и его наличие стоит выяснять до сделки.

Брендовый сервер попросит комплект

В Dell PowerEdge — и похожим образом у других вендоров — GPU не «просто вставляется». Нужен комплект GPU enablement kit: специальные райзеры, кабели питания GPU (у каждого поколения серверов свои), воздуховод, усиленные вентиляторы. В комплекте б/у машины этих деталей часто нет, а по отдельности они ищутся долго. Уточняйте состав поставки заранее.

Драйверы и CUDA: сверьте поколение со своим софтом

Обычные драйверы и CUDA раздаются бесплатно, без регистрации и контрактов. Но у каждой архитектуры есть срок жизни, и для вторички это главный фильтр.

Kepler (K80) — всё: последняя ветка драйверов R470 вышла в 2021 году и сопровождалась до сентября 2024-го, последняя совместимая CUDA — 11.x. Maxwell, Pascal и Volta — на выходе: CUDA 12.9 стала для них последней, CUDA 13.0 (2025) эти архитектуры уже не поддерживает. На практике P40 и V100 продолжают работать — на CUDA 12.x и ветке драйверов 580, — но свежие версии PyTorch и TensorFlow постепенно перестанут их видеть.

Вывод короткий: до покупки проверьте, какую версию CUDA требует ваш софт. T4 и новее — спокойный выбор на годы. P40 и V100 — осознанный компромисс с потолком CUDA 12.x. K80 — только если ваше ПО заморожено и обновляться не будет.

vGPU: лицензия — часть бюджета

Разделить одну карту между несколькими виртуальными машинами — технология зрелая, но платная. NVIDIA продаёт подписку на каждого одновременного пользователя: vApps для потоковых приложений, vPC для виртуальных рабочих столов, vWS для виртуальных рабочих станций. Лицензии плавающие, выдаются лицензионным сервером или порталом NVIDIA.

Без лицензии виртуальный GPU запустится, но в полную силу проработает лишь 20 минут после старта ВМ: затем производительность принудительно снижается, а через 24 часа — ещё раз. Вариант «поработаем без лицензии» годится только для стенда.

И не каждая карта вообще поддерживает vGPU. В официальной таблице есть T4, P40, V100, A2, A16, A40, L4, L40S (старые — в режимах ограниченной поддержки). A100 и A30 в ней отсутствуют — это чисто вычислительные карты, их виртуализация идёт через пакет NVIDIA AI Enterprise. Потребительские GeForce не поддерживаются вовсе. Если задача — отдать всю карту одной ВМ, есть простой путь: проброс целиком (GPU pass-through) — плавающая лицензия при этом с сервера не забирается.

Проверка б/у ускорителя: полчаса, которые окупаются

Серверные карты рассчитаны на круглосуточную работу в ЦОД: память с ECC, пассивная конструкция без изнашивающихся вентиляторов. Но историю конкретного экземпляра это не отменяет. Для потребительских карт перемаркировки задокументированы — перебитые RTX 3080 Ti продавали под видом RTX 4090; по оценке профильного сервиса проверки GPU, перемаркированные и нерабочие экземпляры встречаются и среди профессиональных карт. Поэтому проверка перед покупкой обязательна.

Минимальный протокол:

  • nvidia-smi — температура, энергопотребление, счётчики ошибок ECC. Серверные карты их ведут; ненулевые значения — повод торговаться или отказаться;
  • dcgmi diag -r 3 — фирменная диагностика NVIDIA DCGM: память, шина, пропускная способность;
  • стресс-тест gpu-burn или GPUStressTest с контролем температуры под нагрузкой;
  • комплектация: правильный кабель питания под вашу карту и сервер (про EPS-12V — выше);
  • форм-фактор: PCIe — в обычный сервер, SXM — только в шасси HGX/DGX.

Планируете виртуализацию — сверьте карту с таблицей поддержки vGPU до оплаты, а не после.

Сети: наследие Mellanox

В 2020 году NVIDIA закрыла покупку Mellanox примерно за 6,9 млрд долларов — так появилось направление NVIDIA Networking: адаптеры ConnectX, DPU BlueField, коммутаторы Spectrum и Quantum. Сегодня сети приносят компании больше 31 млрд долларов в год, а Ethernet-платформа Spectrum-X выбрана для крупнейших ИИ-проектов, включая Stargate. Об адаптерах и коммутаторах подробно — на отдельной странице бренда Mellanox.

NVIDIA и Россия

Продажи в РФ остановлены в марте 2022 года; в октябре того же года компания закрыла российский офис, работавший с 2003 года, — около 240 сотрудников. Вендорской гарантии и поддержки в стране нет.

С топовыми ускорителями ситуация жёстче. 26 августа 2022 года власти США ввели лицензионное требование на экспорт A100, H100 и будущих сопоставимых чипов в Китай и Россию; NVIDIA тогда же уточнила, что в Россию не продаёт вовсе. Официального канала поставки A100, H100, H200 и карт Blackwell в РФ не существует.

Массовые карты прошлых поколений — T4, V100, P40 и старше — обращаются на российском вторичном рынке. Механизм параллельного импорта легализован в РФ с 2022 года, и NVIDIA не входит в перечень 20 брендов, исключённых из него приказом Минпромторга №4769. Гарантию в любом случае даёт продавец, не производитель. Драйверы, CUDA и документация остаются в открытом доступе на сайтах NVIDIA.

Линейки продуктов

Линейки NVIDIA

Вычислительные GPU для ЦОД

Карты PCIe для запуска нейросетей, обучения моделей и обработки видео: T4, V100, P40 на вторичном рынке, L4 и L40S — текущее поколение. T4 и L4 питаются от слота и встают в стандартный 1U/2U-сервер без переделок.

Карты для VDI и виртуализации

A2, A16, A40 и T4 с официальной поддержкой vGPU — виртуальные рабочие столы и рабочие станции. A16 несёт четыре GPU по 16 ГБ на одной плате. Лицензии vGPU — платная подписка, расчёт по одновременным пользователям.

Сетевое оборудование NVIDIA Networking

Адаптеры ConnectX, DPU BlueField, коммутаторы Spectrum и Quantum — наследие Mellanox, купленной в 2020 году. Подробное описание — на странице бренда Mellanox.

Гарантия

Гарантийные условия NVIDIA

Вендорской гарантии NVIDIA в России нет: продажи остановлены в марте 2022 года, офис закрыт в октябре 2022-го. Гарантию на серверные ускорители даёт продавец. Перед покупкой уточняйте срок гарантии, условия замены и проводился ли нагрузочный тест перед отгрузкой — для б/у GPU это обязательный минимум. Драйверы и CUDA при этом остаются в открытом доступе на сайтах NVIDIA.

Техподдержка

Выделенная линия поддержки

+7 (812) 425-36-98 Позвонить в поддержку