Новости

Проверка сделки NVIDIA и Groq: нужно ли менять закупку на 2027 год

Дмитрий Потоцкий 1 мин чтения
Проверка сделки NVIDIA и Groq: нужно ли менять закупку на 2027 год

Минюст США проверяет сделку NVIDIA с Groq, но останавливать закупку GPU-инфраструктуры из-за этой новости не нужно. The New York Times и Reuters называют вероятным последствием штраф. Требование отменить лицензионное соглашение оба издания считают маловероятным.

Для закупочного комитета это риск поставщика, а не причина пересобирать архитектуру. Продолжай считать стойку NVIDIA, сравнивай Groq 3 LPX с альтернативами и требуй письменный срок поставки. Четыре числа по-прежнему важнее расследования: p95 задержки, скорость генерации, стоимость миллиона токенов и дата ввода оборудования.

Минюст проверяет форму сделки, а не Groq 3 LPX

NVIDIA получила неисключительную лицензию на технологии Groq и наняла нескольких руководителей компании, включая основателя Джонатана Росса. Минюст проверяет, не выбрали ли стороны такую конструкцию ради обхода антимонопольного контроля. Ведомство уже направило NVIDIA формальный запрос информации, сообщают The New York Times и Reuters.

Две стойки в машинном зале

Даже сумма договорённостей пока расходится. Reuters пишет о $17 млрд, CNBC и The Next Platform — о $20 млрд. Фиксировать одну из оценок в финансовой модели как подтверждённую цену сделки нельзя. Для выбора платформы это расхождение ничего не меняет: проверка касается поведения NVIDIA, а не производительности оборудования.

Ни The New York Times, ни Reuters не сообщают о судебном запрете на поставки или требовании приостановить лицензию. На 15 сентября 2026 года публичный сценарий выглядит так: расследование продолжается, возможен штраф, отмена договорённостей маловероятна.

Поставки идут по прежнему графику

В августе 2026 года NVIDIA объявила Groq 3 LPX серийным продуктом. По данным CNBC, первая стойка должна заработать у Nebius позднее в 2026 году рядом с процессорами Vera и ускорителями Rubin.

Groq также сообщил о совместной работе с Dell Technologies над развёртыванием Groq 3 LPX и Vera Rubin NVL72. Это заявление коммерческих участников проекта, а не срок из договора конкретного заказчика. В закупочном плане его можно использовать как ориентир, но не как гарантию поставки.

Поэтому в календаре нужны две даты: обещанная производителем готовность продукта и зафиксированный поставщиком ввод твоей стойки. Первая годится для планирования пилота. Финансирование, миграцию и обязательства перед бизнесом привязывай ко второй.

Groq 3 LPX имеет смысл для генерации с низкой задержкой

Одна стойка Groq 3 LPX объединяет 256 чипов. На каждом чипе размещено 500 МБ SRAM — быстрой памяти непосредственно на кристалле, указывает CNBC.

В тесте Artificial Analysis стойка выдала 3400 выходных токенов в секунду на Gemma 4 31B с контекстом 100 тысяч токенов. Groq приводит тот же результат в своём сообщении от 24 августа 2026 года.

Эта цифра не переносится на твою модель автоматически. Результат зависит от архитектуры модели, длины контекста, размера пакета и способа измерения задержки. Кроме того, Groq 3 LPX ускоряет преимущественно decode — этап, на котором модель последовательно генерирует ответ. Для обучения, подготовки контекста и пакетной обработки нужен другой вычислительный контур.

Заявление Groq о четырёхкратном росте интерактивности тоже нельзя переносить в ТЗ. Компания сравнивает LPX с неназванной альтернативной платформой, поэтому проверить исходную конфигурацию и условия теста невозможно.

Вместо пересказа рекламной метрики запроси прогон своей модели. В протоколе должны стоять четыре параметра: длина контекста, число одновременных запросов, выходные токены в секунду и p95 времени ответа. Средняя задержка проблему скрывает: девять запросов могут пройти быстро, а десятый задержит операцию пользователя.

Если оборудование будет загружено не постоянно, сначала посчитай границу между собственной GPU-стойкой и облаком. Расследование Минюста не меняет ни месячную загрузку, ни цену электроэнергии, ни стоимость простоя.

Спецификация под задачу

Возьмём типовой пилот интерактивного помощника: модель класса 31B, контекст до 100 тысяч токенов, 100 одновременных сессий и целевая скорость 20 выходных токенов в секунду на сессию. Это допущение для расчёта, а не описание твоей нагрузки.

Требуемая скорость генерации равна 100 × 20 = 2000 токенов в секунду. Результат Artificial Analysis в 3400 токенов в секунду даёт запас 1,7 раза: 3400 ÷ 2000. Этого хватает, чтобы взять одну стойку в пилот, но не доказывает результат на другой модели.

Под такой сценарий закупочная спецификация выглядит так:

  • Генерация ответа: одна стойка NVIDIA Groq 3 LPX, 256 чипов Groq 3 с 500 МБ SRAM на каждом. Приёмка — только по тесту целевой модели с нагрузкой 100 одновременных сессий.
  • Подготовка контекста и остальные вычисления: одна Vera Rubin NVL72. Эта система объединяет 72 ускорителя в общем контуре обмена памятью; LPX не заменяет её в обучении и подготовке входных данных.
  • Сеть: два независимых подключения вычислительных стоек к фабрике. Скорость интерфейсов поставщик указывает после замера объёма обмена между подготовкой контекста и генерацией — в доступных материалах NVIDIA и Groq этого числа нет.
  • Питание: вводы A и B с раздельной защитой. Потребление, тип разъёмов и запас системы охлаждения нужно получить в техническом предложении: опубликованные материалы не содержат этих характеристик.
  • Размещение: две позиции под стойки и заранее проверенный маршрут доставки. Для NVL72 отдельно сверь нагрузку на пол и ограничения монтажа.
  • Резерв платформы: совместимый путь запуска модели на другом ускорителе. AMD уже развивает стоечные системы совместно с Cerebras, поэтому альтернативу можно проверить на том же наборе запросов.

Если одновременных сессий 50, расчётная потребность снизится до 1000 токенов в секунду. Покупка целой LPX-стойки тогда потребует отдельного обоснования: запас вырастет до 3,4 раза, а часть мощности будет простаивать.

При 200 сессиях потребуется уже 4000 токенов в секунду. Публичный результат в 3400 ниже цели, поэтому одной стойки по этому расчёту недостаточно. Нужен тест второй стойки или пересмотр требования к скорости одной сессии.

Главный компромисс такой: связка LPX и Vera Rubin сокращает задержку генерации, но привязывает вычислительный контур, график поставок и сервис к одной дорожной карте NVIDIA. Отдельный альтернативный стенд стоит денег, зато показывает цену переноса до того, как первая платформа станет единственной.

Что записать в решение закупочного комитета

Проект не нужно ставить на паузу из-за проверки Минюста. В решение комитета внеси расследование как юридический риск поставщика и потребуй уведомлять заказчика об ограничениях лицензии, поставок или поддержки.

Groq 3 LPX оставляй в сравнении, если p95 задержки влияет на работу пользователей: например, определяет время ответа голосового помощника или агента разработки. Если задача сводится к обучению, ночной пакетной обработке либо минимальной цене владения, новость о сделке не даёт оснований менять выбранную GPU-платформу.

На пилот бери одну LPX-стойку вместе с контуром Vera Rubin NVL72 только при подтверждённой нагрузке около 2000 выходных токенов в секунду. До договора запроси тест своей модели, цену миллиона токенов, срок ввода и условия переноса нагрузки. Расследование не меняет ни одного из этих четырёх чисел.