Мережа, оптимізована під шини
Мережа, оптимізована під шини, — це топологія мережі кластеру GPU, яка підключає мережеву карту (NIC) з однаковим індексом на кожному сервері до одного й того ж листового комутатора, створюючи виділені «шини» так, щоб трафік GPU-до-GPU між кількома вузлами досягав пункту призначення найменшою кількістю переходів. Це зменшує конкуренцію за пропускну здатність та затримку порівняно зі звичайними конструкціями top-of-rack, і є еталонною архітектурою для Nvidia DGX SuperPOD та великих кластерів AI гіперскалерів. Мережі, оптимізовані під шини, зазвичай працюють на базі InfiniBand або RoCE Ethernet і спаруються з міжсерверним взаємозв'язком NVLink GPU, утворюючи двошаровий хребет — внутрішньосерверний NVLink плюс міжсерверна мережа, оптимізована під шини, — що дозволяє тисячам GPU працювати як єдиний кластер для навчання. Проектування істотно впливає на вимоги до щільності електроенергії та кабельних маршрутів об'єкту, безпосередньо впливаючи на ціни колокації для простору, готового до AI.
Де це трапляється
Суміжні терміни