Карта поколений: что реально купить и зачем
До мая 2020 года серверные ускорители NVIDIA назывались Tesla. От имени отказались из-за путаницы с автомобильной маркой — официально теперь это NVIDIA Data Center GPU, но на вторичном рынке карты так и продаются под старыми названиями: Tesla P40, Tesla V100.
Рабочие лошадки вторички. Три карты закрывают большинство задач. T4 (Turing, 2018) — 16 ГБ GDDR6 при 70 Вт: низкопрофильная, однослотовая, питается от слота PCIe без дополнительных кабелей — встаёт в стандартный 1U/2U-сервер без переделок. Её стихия — запуск обученных нейросетей (инференс), перекодирование видео, виртуальные рабочие столы. V100 (Volta, 2017) — 16 или 32 ГБ HBM2, первый ускоритель с тензорными ядрами, несколько лет был отраслевым стандартом обучения нейросетей. P40 (Pascal, 2016) — 24 ГБ GDDR5, 250 Вт; по отзывам сообщества локальных языковых моделей, самый дешёвый способ получить 24 ГБ видеопамяти (на мировом рынке — порядка 150–200 долларов), расплата — слабый FP16 и хлопоты с охлаждением и питанием. K80 брать уже почти бессмысленно — драйверы для Kepler закончились; M60 — только под старый софт, который не будет обновляться.
Для VDI. Поколение Ampere принесло специализированные карты: компактную A2 (16 ГБ) и A16 — четыре GPU по 16 ГБ на одной плате специально под виртуальные рабочие столы. Для тяжёлой графики в ВМ есть A40 с 48 ГБ.
Текущие универсалы. L4 (24 ГБ, 72 Вт) — прямая наследница T4 в том же формате «в любой сервер». L40S (48 ГБ GDDR6, 350 Вт, два слота) — карта «на всё сразу»: нейросети, графика, рендеринг.
Флагманы — отдельный мир. A100, H100 (80 ГБ HBM3, до 700 Вт), H200 и поколение Blackwell в Россию официально не поставляются — на них действует экспортный контроль США, подробнее ниже. И один нюанс на будущее: флагманы выпускаются в двух форм-факторах — PCIe-карта и SXM-модуль. SXM ставится только в специализированные платы HGX/DGX; для обычного сервера он бесполезен, какой бы привлекательной ни была цена.
Установка в сервер: три вещи, которые сжигают деньги
Пассивным картам нужен обдув
У P40, V100 и T4 нет собственных вентиляторов. Это не экономия, а расчёт на сквозной поток воздуха серверного шасси. В корпусе без направленного обдува карта перегреется — сначала сбросит частоты, потом откажет. Перед покупкой убедитесь, что сервер поддерживает GPU-конфигурацию: нужный набор вентиляторов, воздуховод.
Разъём питания: EPS-12V, а не PCIe
Главная ловушка для новичка. Карты Tesla с дополнительным питанием — K80, M40/M60, P40, P100, V100 PCIe — берут питание через 8-контактный разъём CPU (EPS-12V). Внешне он почти неотличим от PCIe 8-pin, но распиновка другая. В сообществе r/homelab и на форуме NVIDIA это дежурное предупреждение: подключите обычный PCIe-кабель — рискуете сжечь карту или блок питания. Нужен правильный кабель или переходник, и его наличие стоит выяснять до сделки.
Брендовый сервер попросит комплект
В Dell PowerEdge — и похожим образом у других вендоров — GPU не «просто вставляется». Нужен комплект GPU enablement kit: специальные райзеры, кабели питания GPU (у каждого поколения серверов свои), воздуховод, усиленные вентиляторы. В комплекте б/у машины этих деталей часто нет, а по отдельности они ищутся долго. Уточняйте состав поставки заранее.
Драйверы и CUDA: сверьте поколение со своим софтом
Обычные драйверы и CUDA раздаются бесплатно, без регистрации и контрактов. Но у каждой архитектуры есть срок жизни, и для вторички это главный фильтр.
Kepler (K80) — всё: последняя ветка драйверов R470 вышла в 2021 году и сопровождалась до сентября 2024-го, последняя совместимая CUDA — 11.x. Maxwell, Pascal и Volta — на выходе: CUDA 12.9 стала для них последней, CUDA 13.0 (2025) эти архитектуры уже не поддерживает. На практике P40 и V100 продолжают работать — на CUDA 12.x и ветке драйверов 580, — но свежие версии PyTorch и TensorFlow постепенно перестанут их видеть.
Вывод короткий: до покупки проверьте, какую версию CUDA требует ваш софт. T4 и новее — спокойный выбор на годы. P40 и V100 — осознанный компромисс с потолком CUDA 12.x. K80 — только если ваше ПО заморожено и обновляться не будет.
vGPU: лицензия — часть бюджета
Разделить одну карту между несколькими виртуальными машинами — технология зрелая, но платная. NVIDIA продаёт подписку на каждого одновременного пользователя: vApps для потоковых приложений, vPC для виртуальных рабочих столов, vWS для виртуальных рабочих станций. Лицензии плавающие, выдаются лицензионным сервером или порталом NVIDIA.
Без лицензии виртуальный GPU запустится, но в полную силу проработает лишь 20 минут после старта ВМ: затем производительность принудительно снижается, а через 24 часа — ещё раз. Вариант «поработаем без лицензии» годится только для стенда.
И не каждая карта вообще поддерживает vGPU. В официальной таблице есть T4, P40, V100, A2, A16, A40, L4, L40S (старые — в режимах ограниченной поддержки). A100 и A30 в ней отсутствуют — это чисто вычислительные карты, их виртуализация идёт через пакет NVIDIA AI Enterprise. Потребительские GeForce не поддерживаются вовсе. Если задача — отдать всю карту одной ВМ, есть простой путь: проброс целиком (GPU pass-through) — плавающая лицензия при этом с сервера не забирается.
Проверка б/у ускорителя: полчаса, которые окупаются
Серверные карты рассчитаны на круглосуточную работу в ЦОД: память с ECC, пассивная конструкция без изнашивающихся вентиляторов. Но историю конкретного экземпляра это не отменяет. Для потребительских карт перемаркировки задокументированы — перебитые RTX 3080 Ti продавали под видом RTX 4090; по оценке профильного сервиса проверки GPU, перемаркированные и нерабочие экземпляры встречаются и среди профессиональных карт. Поэтому проверка перед покупкой обязательна.
Минимальный протокол:
nvidia-smi— температура, энергопотребление, счётчики ошибок ECC. Серверные карты их ведут; ненулевые значения — повод торговаться или отказаться;dcgmi diag -r 3— фирменная диагностика NVIDIA DCGM: память, шина, пропускная способность;- стресс-тест gpu-burn или GPUStressTest с контролем температуры под нагрузкой;
- комплектация: правильный кабель питания под вашу карту и сервер (про EPS-12V — выше);
- форм-фактор: PCIe — в обычный сервер, SXM — только в шасси HGX/DGX.
Планируете виртуализацию — сверьте карту с таблицей поддержки vGPU до оплаты, а не после.
Сети: наследие Mellanox
В 2020 году NVIDIA закрыла покупку Mellanox примерно за 6,9 млрд долларов — так появилось направление NVIDIA Networking: адаптеры ConnectX, DPU BlueField, коммутаторы Spectrum и Quantum. Сегодня сети приносят компании больше 31 млрд долларов в год, а Ethernet-платформа Spectrum-X выбрана для крупнейших ИИ-проектов, включая Stargate. Об адаптерах и коммутаторах подробно — на отдельной странице бренда Mellanox.
NVIDIA и Россия
Продажи в РФ остановлены в марте 2022 года; в октябре того же года компания закрыла российский офис, работавший с 2003 года, — около 240 сотрудников. Вендорской гарантии и поддержки в стране нет.
С топовыми ускорителями ситуация жёстче. 26 августа 2022 года власти США ввели лицензионное требование на экспорт A100, H100 и будущих сопоставимых чипов в Китай и Россию; NVIDIA тогда же уточнила, что в Россию не продаёт вовсе. Официального канала поставки A100, H100, H200 и карт Blackwell в РФ не существует.
Массовые карты прошлых поколений — T4, V100, P40 и старше — обращаются на российском вторичном рынке. Механизм параллельного импорта легализован в РФ с 2022 года, и NVIDIA не входит в перечень 20 брендов, исключённых из него приказом Минпромторга №4769. Гарантию в любом случае даёт продавец, не производитель. Драйверы, CUDA и документация остаются в открытом доступе на сайтах NVIDIA.