NVIDIA NVLink Fusion: как подружить кастомные XPU с фабрикой ИИ и не сойти с ума
Гиперскейлеры и AI-native компании, строящие кастомные XPU, часто недооценивают сложность превращения чипа в работающую фабрику ИИ: нужно не только спроектировать ускоритель, но и собрать сеть scale-up и scale-out, стойки, охлаждение, софт и экосистему поставщиков. NVIDIA NVLink Fusion решает эту проблему, позволяя встраивать XPU в проверенную инфраструктуру — от NVLink до готовых решений для дата-центров.
Ключевое преимущество — производительность scale-up сети: шестое поколение NVLink обеспечивает задержку между XPU в 3 раза ниже, чем у готовых Ethernet-решений, а пропускная способность пакетов в 10 раз выше. В конфигурации GB300 NVL72 с 72 GPU пропускная способность и интерактивность на GPU выше, чем у B300 без NVL72. В дорожной карте — домены до 1152 ускорителей и сопакетированная оптика. Также NVLink-C2C подключает XPU к CPU Vera или другим процессорам с энергоэффективностью в 6 раз выше PCIe.
NVIDIA подчёркивает, что NVLink Fusion — не просто интерконнект, а готовая платформа с экосистемой партнёров, включая Intel, ASIC-дизайнеров и производителей оптики. Это позволяет командам сосредоточиться на инновациях в XPU, не изобретая велосипед для остальной инфраструктуры. По словам Тима Уилсона из Intel, решение даёт заказчикам гибкость в выборе CPU, производительности и софта под свои задачи.