मेलानॉक्स (एनवीआईडीआईए मेलानॉक्स) एमक्यूएम9790-एनएस2एफ इनफिनीबैंड स्विच इन एक्शन - आरडीएमए/एचपीसी के लिए कम विलंबता इंटरकनेक्ट अनुकूलन
July 13, 2026
मेलानॉक्स (एनवीआईडीआईए मेलानॉक्स) एमक्यूएम9790-एनएस2एफ इनफिनीबैंड स्विच इन एक्शन - आरडीएमए/एचपीसी/एआई क्लस्टर के लिए कम विलंबता इंटरकनेक्ट अनुकूलन
जैसे-जैसे एआई प्रशिक्षण क्लस्टर हजारों से दसियों हजार जीपीयू तक बढ़ते हैं, नेटवर्क विलंबता और भीड़ नियंत्रण प्रभावी गणना उपयोग में निर्णायक कारक बन जाते हैं। एक अग्रणी वैश्विक एआई अनुसंधान संगठन ने हाल ही में तैनात कियामेलानॉक्स (NVIDIA मेलानॉक्स) MQM9790-NS2Fअपनी अगली पीढ़ी की सुपरकंप्यूटिंग सुविधा को रेखांकित करने के लिए स्विच करें, बड़े पैमाने पर भाषा मॉडल, आणविक गतिशीलता सिमुलेशन और वितरित गहन शिक्षण का समर्थन करें। यह आलेख वास्तविक-विश्व परिनियोजन की जांच करता है, जिसमें विस्तार से बताया गया है कि यह InfiniBand स्विच RDMA ट्रांसपोर्ट, HPC संचार और AI डेटा-समानांतर प्रशिक्षण फैब्रिक को कैसे बदल देता है।
पृष्ठभूमि और चुनौतियाँ: ईथरनेट समझौता से लेकर दोषरहित इंटरकनेक्ट अनिवार्यता तक
संगठन शुरू में RoCEv2 के साथ 100GbE ईथरनेट फैब्रिक पर निर्भर था। हालाँकि, जैसे-जैसे उनके GPU नोड्स 1,200 से अधिक सर्वर (प्रत्येक 8× NVIDIA H100 GPU के साथ) तक बढ़े, उन्हें लगातार PFC गतिरोध, जटिल ECN ट्यूनिंग और कभी-कभी पैकेट ड्रॉप का सामना करना पड़ा, जिसके कारण प्रशिक्षण रुक गया। इन मुद्दों ने औसत कार्य पूरा होने के समय को 35% से अधिक बढ़ा दिया और नेटवर्क समस्या निवारण में काफी इंजीनियरिंग प्रयास का उपभोग किया। मौजूदा बुनियादी ढांचा अब बड़े पैमाने पर ऑल-रिड्यूस और ऑल-टू-ऑल सामूहिक संचालन के लिए आवश्यक नियतात्मक माइक्रोसेकंड-स्तरीय विलंबता और भीड़-मुक्त थ्रूपुट प्रदान नहीं कर सकता है।
समाधान एवं परिनियोजन:MQM9790-NS2F इनफिनीबैंड स्विचफैब्रिक बैकबोन के रूप में
कई विकल्पों का मूल्यांकन करने के बाद, टीम ने इसका चयन कियाNVIDIA मेलानॉक्स MQM9790-NS2Fएक नए दो-स्तरीय लीफ-स्पाइन आर्किटेक्चर के लिए मुख्य बिल्डिंग ब्लॉक के रूप में। प्रत्येक पत्ती रैक दो से सुसज्जित हैMQM9790-NS2F 400Gb/s NDR 64-पोर्ट OSFPस्विच, प्रति यूनिट 64 ओएसएफपी पोर्ट और 25.6 टीबी/एस की कुल स्विचिंग क्षमता प्रदान करते हैं। प्रति पोर्ट 400 जीबी/एस एनडीआर गति, कट-थ्रू स्विचिंग और अनुकूली रूटिंग के साथ मिलकर, उप-600 एनएस पोर्ट-टू-पोर्ट विलंबता को सक्षम करती है - जो उनके जीपीयू-गहन वर्कलोड के लिए एक महत्वपूर्ण आवश्यकता है। तैनाती का लाभ उठाया गयाMQM9790-NS2F InfiniBand स्विच समाधाननिर्बाध सुनिश्चित करते हुए, NVIDIA क्वांटम‑2 फर्मवेयर के साथ एकीकृतMQM9790-NS2F संगतमौजूदा ConnectX‑7 एडाप्टर और BlueField‑3 DPU के साथ संचालन।
मुख्य परिनियोजन विकल्पों में शामिल हैं:
- टोपोलॉजी:64‑पोर्ट ओएसएफपी से 400जी ऑप्टिकल ट्रांसीवर के साथ नॉन-ब्लॉकिंग फैट-ट्री, सभी जीपीयू नोड्स के लिए पूर्ण-बाइसेक्शन बैंडविड्थ को सक्षम करता है।
- प्रबंध:रीयल-टाइम टेलीमेट्री, कंजेशन डिटेक्शन और प्रोएक्टिव पाथ री-रूटिंग के लिए NVIDIA UFM (यूनिफाइड फैब्रिक मैनेजर)।
- सामूहिक भार:SHARPv3 मेजबान सीपीयू से संचार को ऑफलोड करते हुए, सभी-कम संचालन में तेजी लाने में सक्षम है।
सुचारु परिवर्तन सुनिश्चित करने के लिए, टीम ने परामर्श कियाMQM9790-NS2F डेटाशीटऔरMQM9790-NS2F विशिष्टताएँबिजली और केबलिंग आवश्यकताओं को मान्य करने के लिए। 1यू फॉर्म फैक्टर और अनावश्यक बिजली आपूर्ति उनके मौजूदा रैक घनत्व में अच्छी तरह से फिट होती है, और ओएसएफपी पोर्ट डीएसी केबल और ऑप्टिकल मॉड्यूल दोनों का समर्थन करते हैं, जो भविष्य के विस्तार के लिए लचीलापन प्रदान करते हैं।
मापे गए परिणाम और लाभ - प्रदर्शन और दक्षता में मात्रात्मक लाभ
पूर्ण तैनाती और अनुकूलन के बाद, संगठन ने कई आयामों में महत्वपूर्ण सुधार दर्ज किए:
| मीट्रिक | पहले (RoCEv2) | (MQM9790-NS2F) के बाद |
|---|---|---|
| औसत ऑल-रिड्यूस लेटेंसी (1GB) | ~18 μs | <8 μs |
| टेल लेटेंसी (99.9% ile) | > 150 μs | <15 μs |
| प्रभावी जीपीयू उपयोग | ~72% | ~91% |
| कार्य पूरा करने का समय (औसत) | आधारभूत | ‑28% (1.4× तेज) |
कच्ची संख्या से परे, टीम ने लगभग शून्य भीड़भाड़ संबंधी रुकावटों की सूचना दी, जिससे नेटवर्क संचालन काफी सरल हो गया। की अंतर्निहित टेलीमेट्री और अनुकूली रूटिंगNVIDIA मेलानॉक्स MQM9790-NS2Fमैनुअल ईसीएन ट्विकिंग को समाप्त करते हुए, सभी 64 ओएसएफपी पोर्ट पर स्वचालित लोड संतुलन की अनुमति दी गई। इसके अलावा,MQM9790-NS2F इनफिनीबैंड स्विच95% लिंक उपयोग के तहत भी नियतात्मक प्रदर्शन प्रदान किया - यह उपलब्धि उनके पिछले ईथरनेट सेटअप के साथ असंभव थी।
संगठन ने यह भी नोट किया किMQM9790-NS2F कीमत, जब 5 वर्ष के जीवनचक्र में परिशोधन किया गया, तो प्रति पोर्ट कम बिजली की खपत (≈1.5W प्रति 400जी पोर्ट) और उच्च पोर्ट घनत्व के कारण कम केबलिंग लागत से भरपाई की गई। सामान्य उपलब्धता अब परिपक्व होने के साथ, उन्होंने इसकी पुष्टि कीबिक्री के लिए MQM9790-NS2Fअधिकृत चैनलों के माध्यम से खरीद को सरल बनाया गया, औरMQM9790-NS2F डेटाशीटसभी आवश्यक स्थापना और अनुपालन विवरण प्रदान किए गए।
सारांश और आउटलुक - अगली पीढ़ी के एआई इन्फ्रास्ट्रक्चर के लिए एक ब्लूप्रिंट
को अपनानामेलानॉक्स (NVIDIA मेलानॉक्स) MQM9790-NS2Fइस बड़े पैमाने पर HPC/AI क्लस्टर से पता चलता है कि एक उद्देश्य से निर्मित InfiniBand फैब्रिक अब एक विलासिता नहीं है, बल्कि AI और वैज्ञानिक कंप्यूटिंग की सीमाओं को आगे बढ़ाने वाले संगठनों के लिए एक आवश्यकता है। लगातार उप-माइक्रोसेकंड विलंबता, दोषरहित आरडीएमए परिवहन और इन-नेटवर्क कंप्यूटिंग त्वरण प्रदान करके,MQM9790-NS2F 400Gb/s NDR 64-पोर्ट OSFPस्विच डेटा केंद्रों को हजारों जीपीयू तक निकट-रेखीय स्केलेबिलिटी प्राप्त करने का अधिकार देता है।
आगे देखते हुए, टीम अतिरिक्त सामग्री के साथ फैब्रिक का विस्तार करने की योजना बना रही हैMQM9790-NS2F इनफिनीबैंड स्विचजलवायु मॉडलिंग और जीनोमिक्स सहित आगामी एक्सास्केल-क्लास वर्कलोड का समर्थन करने वाली इकाइयाँ।MQM9790-NS2F संगतभावी NVIDIA पीढ़ियों वाला पारिस्थितिकी तंत्र निवेश सुरक्षा सुनिश्चित करता है। समान उन्नयन का मूल्यांकन करने वाले आर्किटेक्ट और आईटी प्रबंधकों के लिए, यह वास्तविक दुनिया का मामला पुष्टि करता है किMQM9790-NS2F InfiniBand स्विच समाधानउच्च-प्रदर्शन, कम-विलंबता क्लस्टर नेटवर्किंग के लिए एक सिद्ध, लागत-प्रभावी मार्ग प्रदान करता है - एआई नवाचार के अगले दशक के लिए एक महत्वपूर्ण प्रवर्तक।

