NVIDIA Mellanox MQM8790-HS2F InfiniBand स्विच एक्शन मेंः आरडीएमए/एचपीसी/एआई क्लस्टर के लिए कम विलंबता इंटरकनेक्ट का अनुकूलन
August 21, 2026
NVIDIA Mellanox MQM8790-HS2F InfiniBand स्विच एक्शन मेंः आरडीएमए/एचपीसी/एआई क्लस्टर के लिए कम विलंबता इंटरकनेक्ट का अनुकूलन
बड़े पैमाने पर एआई मॉडल प्रशिक्षण और उच्च प्रदर्शन कंप्यूटिंग (एचपीसी) के क्षेत्र में, नेटवर्क विलंबता अक्सर महत्वपूर्ण बाधा बन जाती है जो क्लस्टर स्केलेबिलिटी और दक्षता को सीमित करती है।राष्ट्रीय स्तर के एक सुपरकंप्यूटिंग केंद्र ने हाल ही में बुनियादी ढांचे का एक बड़ा उन्नयन पूरा किया है, एक 100Gb / s EDR InfiniBand कपड़े से एक 200Gb / s HDR समाधान के लिएNVIDIA Mellanox MQM8790-HS2Fइनफिनिबैंड स्विच. इस केस स्टडी में इनकी चुनौतियों, तैनाती की रणनीति और इस अगली पीढ़ी के इंटरकनेक्ट के माध्यम से हासिल किए गए मापने योग्य प्रदर्शन लाभों की जांच की गई है।
पृष्ठभूमि और चुनौतियां: जब विलंबता प्रदर्शन की सीमा बन जाती है
सुपरकंप्यूटिंग केंद्र में 2,000 से अधिक जीपीयू नोड्स वाले एक विषम क्लस्टर का संचालन किया जाता है, जिसमें मौसम सिमुलेशन, जीनोमिक अनुसंधान,और बड़े भाषा मॉडल प्रशिक्षण. पिछले 100Gb/s EDR नेटवर्क के साथ,ऑपरेशंस टीम ने देखा कि सामूहिक संचार ऑपरेशंस जैसे कि ऑल-रिड्यूस और ऑल-ग्रिगिंग, नोड की संख्या बढ़ने के साथ कुल कार्य रनटाइम का एक बढ़ता हिस्सा खपत कर रहे थे।कुछ वितरित प्रशिक्षण कार्यों में, नेटवर्क से संबंधित ओवरहेड ने अंत से अंत तक निष्पादन समय का लगभग 40% हिस्सा लिया, जिससे GPU उपयोग को गंभीर रूप से सीमित किया गया और मॉडल अभिसरण चक्र का विस्तार किया गया।
अतिरिक्त चुनौतियों में शामिल हैंः
- भीड़भाड़ के हॉटस्पॉट:एआई प्रशिक्षण में यातायात के पैटर्न अक्सर फटते और अप्रत्याशित होते हैं, जिससे हेड-ऑफ-लाइन ब्लॉक और टेल लेटेंसी स्पाइक्स होते हैं जो नौकरी शेड्यूलिंग को बाधित करते हैं।
- नेटवर्क में अपर्याप्त त्वरणःपुराने फैब्रिक में उन्नत सामूहिक उतार-चढ़ाव क्षमताओं के लिए समर्थन की कमी थी, जिससे सभी कटौती संचालन मेजबान सीपीयू और मेमोरी पदानुक्रम को पार करने के लिए मजबूर हुए।
- प्रबंधन की जटिलता:समस्या निवारण के लिए कई निगरानी उपकरणों के मैन्युअल विश्लेषण की आवश्यकता होती है, जिससे बड़े पैमाने पर तैनाती में मूल कारणों का पता लगाना मुश्किल हो जाता है।
कई इंटरकनेक्ट विकल्पों का मूल्यांकन करने के बाद, केंद्र नेMQM8790-HS2Fइसके नए कपड़े के लिए नींव के रूप में।MQM8790-HS2F डेटाशीट, यह स्विच 200Gb/s एचडीआर गैर-ब्लॉकिंग थ्रूपुट, सब-130ns कट-थ्रू विलंबता और SHARP v3 के लिए समर्थन के 40 पोर्ट प्रदान करता है।0 सामूहिक ढोना क्षमताएं जो सीधे अपने मुख्य दर्द बिंदुओं को संबोधित करती हैं.
समाधान और तैनातीः एआई/एचपीसी के लिए कम विलंबता वाले कपड़े का निर्माण
तैनाती ने दो-स्तरीय वसा पेड़ टोपोलॉजी को अपनाया, जिसमें 24MQM8790-HS2F 200Gb/s HDR 40-पोर्ट QSFP56पत्तियों के नोड्स के रूप में तैनात स्विच और रीढ़ की हड्डी स्विच के रूप में 8 इकाइयां। इस विन्यास ने 2 प्रदान कींः1 पूरे क्लस्टर में ओवरसब्सक्राइब करने से वर्तमान कार्यभार के लिए पर्याप्त है जबकि भविष्य के विस्तार के लिए अग्रिम स्थान प्रदान करता है.
| तैनाती परत | स्विचों की संख्या | प्रयुक्त पोर्ट | कनेक्टिविटी |
|---|---|---|---|
| पत्ती (प्रति रैक) | 24 | 32 बंदरगाह प्रत्येक | ToR सर्वर + रीढ़ के ऊपरी लिंक |
| कशेरुका | 8 | प्रत्येक में 36 बंदरगाह | सभी पत्ती स्विच के लिए पूर्ण जाल |
प्रत्येक पत्ती स्विच NVIDIA ConnectX-6 HDR होस्ट चैनल एडाप्टर के माध्यम से कंप्यूटिंग नोड्स से जुड़ता है।MQM8790-HS2F संगतऑप्टिक्स और केबलिंग पारिस्थितिकी तंत्र ने टीम को मौजूदा QSFP56 केबलों का पुनः उपयोग करने की अनुमति दी, तैनाती में तेजी लाई और खरीद लागत को कम किया। पूरी भौतिक स्थापना दो सप्ताह के भीतर पूरी हो गई,नियंत्रण विमान के साथ स्वचालित टोपोलॉजी खोज और प्रावधान के लिए NVIDIA के एकीकृत कपड़े प्रबंधक (UFM) का लाभ उठाते हुए.
अनुकूलन रूटिंग और भीड़ नियंत्रण के लिए स्विच का समर्थन एआई वर्कलोड की फट ट्रैफिक विशेषता को संभालने के लिए महत्वपूर्ण साबित हुआ।उपलब्ध मार्गों पर गतिशील रूप से प्रवाहों का पुनर्वितरण करके,MQM8790-HS2F इन्फिनिबैंड स्विचहॉटस्पॉट के गठन को कम से कम किया और पीक जॉब शेड्यूलिंग अवधि के दौरान भी लगातार प्रदर्शन बनाए रखा।
परिणाम और लाभः कार्यप्रवाह और GPU उपयोग में मापने योग्य सुधार
उत्पादन संचालन के तीन महीने के बाद, सुपरकंप्यूटिंग केंद्र ने कई आयामों में महत्वपूर्ण प्रदर्शन लाभ की सूचना दीः
- विलंबता में कमी:औसत एमपीआई पिंग-पोंग विलंबता पिछले ईडीआर कपड़े पर 680 एनएस से घटकर 130 एनएस से कम हो गई।NVIDIA Mellanox MQM8790-HS2F, जो संदेश विनिमय की दक्षता में 5 गुना सुधार का प्रतिनिधित्व करता है।
- सामूहिक परिचालन गतिवर्धन:1024-नोड नौकरियों के लिए सभी-कम विलंबता 62% गिर गई, SHARP v3.0 ऑफलोड के लिए धन्यवाद जो स्विच कपड़े के भीतर सीधे कमी संचालन करता है।
- जीपीयू उपयोगःकम विलंबता और अधिक बैंडविड्थ के संयुक्त प्रभाव ने औसत GPU उपयोग को 72% से बढ़ाकर 91% कर दिया, जो बड़े भाषा मॉडल प्रशिक्षण रन के लिए समाधान के समय में 26% की कमी का अनुवाद करता है।
- कार्य नियोजन की दक्षता:कम पूंछ विलंबता विचलन SLURM शेड्यूलर को प्रदर्शन हस्तक्षेप के बिना नोड्स के एक ही सेट पर अधिक नौकरियों को पैक करने की अनुमति देता है, लगभग 18% तक कुल क्लस्टर थ्रूपुट बढ़ाता है।
जब टीम ने बाद मेंMQM8790-HS2F कीमतअन्य विक्रेताओं के वैकल्पिक स्विच के विरुद्ध, they found that the total cost per Gb/s delivered was highly competitive—especially when factoring in the reduced management overhead and the switch's ability to support both HDR and HDR100 link speeds, मिश्रित गति वाले वातावरण में निवेशों की रक्षा करना।
परिचालन के दृष्टिकोण से, एकीकृत यूएफएम प्लेटफॉर्म ने कपड़े की स्वास्थ्य, यातायात पैटर्न और लिंक-स्तर की त्रुटियों की निगरानी के लिए एक एकल ग्लास पैनल प्रदान किया।इस दृश्यता ने टीम को सक्रिय रूप से खराब होने वाली केबलों की पहचान करने और अनुसूचित रखरखाव के दौरान उन्हें बदलने में सक्षम बनाया, अनियोजित डाउनटाइम से बचने के लिए।
सारांश और परिप्रेक्ष्य: निम्न विलंबता वाले कपड़े की अगली पीढ़ी के लिए एक ब्लूप्रिंट
इस केस स्टडी से पता चलता है किMQM8790-HS2F InfiniBand स्विच समाधानयह एक सरल गति उन्नयन से अधिक है, यह संगठनों के लिए एक परिवर्तनकारी घटक है जो अपने एआई और एचपीसी बुनियादी ढांचे की पूरी प्रदर्शन क्षमता को अनलॉक करना चाहते हैं।उच्च बंदरगाह घनत्व को जोड़कर, अति-कम विलंबता, और इन-नेटवर्क कंप्यूटिंग क्षमताओं, स्विच सीधे संचार की बाधाओं को संबोधित करता है जो ऐतिहासिक रूप से सीमित क्लस्टर स्केलेबिलिटी है।
आगे देखते हुए, सुपरकंप्यूटिंग केंद्र अगले वित्तीय वर्ष में अपने नेटवर्क का विस्तार 2,400 नोड्स तक करने की योजना बना रहा है, उसी का लाभ उठाते हुएMQM8790-HS2Fअतिरिक्त रीढ़ स्विच के साथ आर्किटेक्चर. टीम SHARP v3.0 के उन्नत कटौती एल्गोरिदम के लिए स्विच के समर्थन का भी पता लगा रही है,जो ग्राफ न्यूरल नेटवर्क और सुदृढीकरण सीखने जैसे उभरते कार्यभारों को और तेज करने का वादा करते हैं।.
आईटी प्रबंधकों, नेटवर्क आर्किटेक्ट और इंजीनियरों के लिए अपने स्वयं के क्लस्टर बिल्ड के लिए इंटरकनेक्ट विकल्पों का मूल्यांकन करना,NVIDIA Mellanox MQM8790-HS2Fउप-माइक्रोसेकंड विलंबता, अधिकतम जीपीयू उपयोग और सरलीकृत फैब्रिक प्रबंधन प्राप्त करने के लिए एक सिद्ध, क्षेत्र-प्रमाणित मार्ग प्रदान करता है। विस्तृतMQM8790-HS2F विनिर्देशऔर संदर्भ डिजाइन NVIDIA के तकनीकी प्रलेखन पोर्टल से उपलब्ध हैं और स्विच अब व्यापक रूप से उपलब्ध हैबिक्री के लिए MQM8790-HS2Fएक क्षेत्रीय साझेदार का पता लगाने के लिए।

