
Американская технологическая компания Nvidia объявила о начале полномасштабного производства стоек Groq 3 LPX, сообщает CNBC. Новое оборудование будет интегрировано совместно с центральными процессорами Vera и графическими процессорами Rubin в облачной инфраструктуре Nebius и начнет работу до конца текущего года.
Стремление корпорации ускорить выпуск чипов связано с растущей потребностью в логическом выводе* с низкой задержкой, что необходимо для быстрого отклика агентов искусственного интеллекта. Старший директор Nvidia Дион Харрис отметил, что это «открывает возможность предлагать премиальные уровни обслуживания для тех пользователей и клиентов, которые действительно требуют соглашений об обслуживании, наиболее чувствительных к задержкам». Стойка вмещает 256 чипов и способна обрабатывать 3400 токенов** в секунду. При этом новые процессоры не заменят традиционные графические ускорители, а будут использоваться для конкретных задач декодирования. Генеральный директор Дженсен Хуанг ожидает, что совокупные продажи чипов Blackwell и систем Vera Rubin достигнут $1 трлн к 2027 году.
Коммерциализация новой технологии стала результатом крупнейшего приобретения в истории корпорации. В декабре 2025 года Nvidia выкупила активы стартапа по производству чипов Groq за $20 млрд. Архитектура приобретенных процессоров включает 500 мегабайт быстрой памяти на самом кристалле для устранения узких мест. Производством чипов Groq занимается южнокорейская Samsung, в то время как графические процессоры для Nvidia традиционно выпускает Taiwan Semiconductor Manufacturing.
*Логический вывод — процесс работы уже обученной модели искусственного интеллекта, когда она анализирует входящие данные и выдает результат или прогноз. В отличие от обучения, этот этап требует мгновенной реакции системы, поэтому низкая задержка критически важна для работы чат-ботов и автономных систем.
**Токен — базовая единица текстовой информации, которую обрабатывают нейросети, представляющая собой слово, часть слова или отдельный символ. Скорость обработки токенов в секунду определяет, насколько быстро искусственный интеллект может генерировать осмысленный текст или код.
Подпишись на MP в MAX
в удобном формате