NVIDIA представила архитектуру Vera Rubin и Groq 3 LPX для AI-фабрик
NVIDIA анонсировала ключевые компоненты архитектуры Vera Rubin для следующей генерации дата-центров на конференции Hot Chips 2026. Компания смещает фокус с отдельных чипов на целостные системы, где Vera Rubin NVL72 выступает центральным вычислительным фундаментом для обучения и инференса, а новые решения дополняют его в задачах генерации токенов и масштабирования сети.
Для ускорения критически важных фаз декодирования NVIDIA представила Groq 3 LPX. Это серверная система, способная интегрировать до 256 ускорителей LP30 с прямыми соединениями чип-к-чипу. Производительность системы оценивается в 3400 токенов в секунду при работе с моделью Gemma 4 31B и контекстом из 100 тысяч токенов, что обеспечивает низкую задержку для агентных рабочих нагрузок.

Сетевая инфраструктура получила обновление в виде платформы Spectrum-X Multiplane. Она позволяет масштабировать кластеры до 512 тысяч GPU без необходимости добавлять третью переключающую плоскость, что снижает сложность и задержки. Технология использует несколько независимых сетевых путей: при отказе одного из них пропускная способность снижается лишь на 10%, а аппаратное восстановление работает в 11 раз быстрее программного перераспределения нагрузки.

В состав платформы также входят BlueField-4 с поддержкой Scale-In для управления сетью и хранилищем, а также технология NVLink Fusion, объединяющая шестое поколение NVLink. Эти решения формируют единую экосистему для создания высокопроизводительных AI-фабрик.

