मेलानॉक्स (एनवीआईडीआईए मेलानॉक्स) एमक्यूएम9790-एनएस2एफ इनफिनीबैंड स्विच तकनीकी समाधान

July 13, 2026

मेलानॉक्स (एनवीआईडीआईए मेलानॉक्स) एमक्यूएम9790-एनएस2एफ इनफिनीबैंड स्विच तकनीकी समाधान

मेलानॉक्स (एनवीआईडीआईए मेलानॉक्स) एमक्यूएम9790-एनएस2एफ इनफिनीबैंड स्विच तकनीकी समाधान - आरडीएमए/एचपीसी/एआई क्लस्टर के लिए कम विलंबता इंटरकनेक्ट अनुकूलन

यह तकनीकी श्वेत पत्र पर केन्द्रित एक व्यापक समाधान वास्तुकला प्रस्तुत करता हैमेलानॉक्स (NVIDIA मेलानॉक्स) MQM9790-NS2Fइन्फिनीबैंड स्विच। नेटवर्क आर्किटेक्ट्स, प्री-सेल्स इंजीनियरों और ऑपरेशंस लीड्स के उद्देश्य से, दस्तावेज़ विवरण देता है कि कैसेएमक्यूएम9790-एनएस2एफअगली पीढ़ी के एचपीसी और एआई बुनियादी ढांचे के लिए नियतात्मक अल्ट्रा-लो विलंबता, दोषरहित आरडीएमए और स्केलेबल बैंडविड्थ प्रदान करता है। हम डिज़ाइन सिद्धांतों, परिनियोजन टोपोलॉजी, परिचालन सर्वोत्तम प्रथाओं और प्रदर्शन सत्यापन को कवर करते हैं।

1. परियोजना पृष्ठभूमि और आवश्यकताओं का विश्लेषण

आधुनिक एआई प्रशिक्षण और वैज्ञानिक सिमुलेशन वर्कलोड ऐसे नेटवर्क फैब्रिक की मांग करते हैं जो सब-माइक्रोसेकंड जिटर के साथ बड़े पैमाने पर ऑल-रिड्यूस, ऑल-इकट्ठा और पॉइंट-टू-पॉइंट संचार पैटर्न को बनाए रख सकें। पारंपरिक ईथरनेट-आधारित समाधान, यहां तक ​​कि RoCEv2 के साथ, भीड़ प्रबंधन, पीएफसी ट्यूनिंग और टेल-विलंबता नियंत्रण में जटिलता पेश करते हैं, जिससे अक्सर अकुशल जीपीयू उपयोग और अप्रत्याशित कार्य पूरा होने का समय होता है।

विशिष्ट एचपीसी/एआई परियोजनाओं में पहचानी गई प्रमुख आवश्यकताओं में शामिल हैं:

  • पूर्ण लोड के तहत एंड-टू-एंड विलंबता <1 μs (पोर्ट-टू-पोर्ट स्विच करें)
  • भीड़भाड़ के कारण शून्य पैकेट ड्रॉप वाला दोषरहित कपड़ा
  • वास्तु परिवर्तन के बिना 64 से 2,000 जीपीयू नोड्स तक स्केलेबिलिटी
  • समृद्ध टेलीमेट्री और स्वचालित दोष पुनर्प्राप्ति के साथ सरलीकृत संचालन

NVIDIA मेलानॉक्स MQM9790-NS2Fएनडीआर 400 जीबी/एस तकनीक, अनुकूली रूटिंग और इन-नेटवर्क कंप्यूटिंग को 1यू, 64-पोर्ट ओएसएफपी प्लेटफॉर्म में एकीकृत करके इन मांगों को सीधे संबोधित करता है।

2. समग्र नेटवर्क/सिस्टम आर्किटेक्चर डिज़ाइन

अनुशंसित वास्तुकला पूर्ण द्विभाजन बैंडविड्थ और उच्च लचीलापन प्रदान करने के लिए दो-स्तरीय पत्ती-रीढ़ (या वसा-वृक्ष) टोपोलॉजी को अपनाती है। प्रत्येक लीफ ब्लॉक में कई रैक होते हैं, प्रत्येक रैक में दो आवास होते हैंMQM9790-NS2F InfiniBand स्विचअतिरेक के लिए. रीढ़ की हड्डी की परत सभी लीफ स्विचों से ट्रैफ़िक एकत्र करती है, जो किन्हीं दो समापन बिंदुओं के बीच गैर-अवरुद्ध संचार सुनिश्चित करती है।

MQM9790-NS2F 400Gb/s NDR 64-पोर्ट OSFPस्विच पत्ती और रीढ़ दोनों के रूप में कार्य करता है, पूरे कपड़े में एक समान हार्डवेयर प्रदान करता है - स्पेयरिंग और रखरखाव को सरल बनाता है। 1,024‑GPU क्लस्टर के लिए, एक विशिष्ट डिज़ाइन में 16 लीफ स्विच (प्रत्येक 64 GPU कनेक्ट करता है) और 8 स्पाइन स्विच का उपयोग किया जाता है, जो सभी 400G ऑप्टिकल या DAC केबल के माध्यम से परस्पर जुड़े होते हैं। फैब्रिक फैट-ट्री और ड्रैगनफ्लाई+ टोपोलॉजी दोनों का समर्थन करता है, जिसमें अनुकूली रूटिंग गतिशील रूप से कई पथों पर ट्रैफ़िक को संतुलित करती है।

3. की ​​भूमिका एवं मुख्य विशेषताएंमेलानॉक्स (NVIDIA मेलानॉक्स) MQM9790-NS2Fसमाधान में

NVIDIA मेलानॉक्स MQM9790-NS2Fइस समाधान की आधारशिला है, जो प्रदान करती है:

  • 64 ओएसएफपी पोर्टप्रत्येक 400 जीबी/एस (एनडीआर) पर काम कर रहा है - 25.6 टीबी/एस की कुल स्विचिंग क्षमता, 600 एनएस से नीचे कट-थ्रू विलंबता के साथ।
  • अनुकूली रूटिंग- गतिशील रूप से प्रति पैकेट कम से कम भीड़-भाड़ वाले पथ का चयन करता है, हॉटस्पॉट लिंक से बचता है और असममित ट्रैफ़िक पैटर्न के तहत भी लगातार विलंबता बनाए रखता है।
  • SHARPv3 (स्केलेबल पदानुक्रमित एकत्रीकरण और न्यूनीकरण प्रोटोकॉल)- होस्ट सीपीयू से सामूहिक संचार (सभी को कम करना, प्रसारित करना) को ऑफलोड करता है, नेटवर्क चैटर को कम करता है और एआई प्रशिक्षण को 20-30% तक तेज करता है।
  • इन-नेटवर्क कंप्यूटिंग- सीधे स्विच पर डेटा कटौती, विभाजन और यहां तक ​​कि छोटे पैमाने के एमपीआई संचालन का समर्थन करता है, जिससे गणना के लिए मूल्यवान जीपीयू संसाधन मुक्त हो जाते हैं।
  • टेलीमेट्री एवं भीड़भाड़ प्रबंधन- प्रति-प्रवाह काउंटर, बफर अधिभोग हिस्टोग्राम और पथ-स्तरीय विलंबता मेट्रिक्स सहित अंतर्निहित उन्नत निगरानी, ​​सभी यूएफएम या आरईएसटी एपीआई के माध्यम से निर्यात योग्य हैं।

ये क्षमताएं सक्षम बनाती हैंMQM9790-NS2F InfiniBand स्विच समाधानआंतरिक बेंचमार्क और ग्राहक तैनाती द्वारा मान्य पैमाने पर नियतात्मक प्रदर्शन प्रदान करना।MQM9790-NS2F विशिष्टताएँइसमें निष्क्रिय कॉपर डीएसी और सक्रिय ऑप्टिकल मॉड्यूल दोनों के लिए समर्थन भी शामिल है, जो 100 मीटर (400जी एसआर4 ऑप्टिक्स के साथ) और उससे आगे की दूरी के लिए लचीलापन प्रदान करता है।

4. परिनियोजन और स्केलिंग अनुशंसाएँ (विशिष्ट टोपोलॉजी)

ग्रीनफ़ील्ड परिनियोजन के लिए, हम निम्नलिखित चरणबद्ध दृष्टिकोण की अनुशंसा करते हैं:

  • चरण 1 - पायलट:2 लीफ स्विच (प्रत्येक) तैनात करेंएमक्यूएम9790-एनएस2एफ) और 128 जीपीयू को जोड़ने वाले 2 स्पाइन स्विच। के विरुद्ध प्रदर्शन मान्य करेंMQM9790-NS2F डेटाशीटपैरामीटर.
  • चरण 2 - स्केल-आउट:प्रति रैक 2 की वृद्धि में लीफ स्विच जोड़ें, और ओवरसब्सक्रिप्शन ≤ 1:1 बनाए रखने के लिए आवश्यकतानुसार स्पाइन स्विच जोड़ें। 64‑पोर्ट घनत्व एक एकल स्विच को 64 GPU नोड्स के पूर्ण रैक को होस्ट करने की अनुमति देता है (यदि प्रत्येक नोड में एक एकल 400G अपलिंक है)।
  • चरण 3 - मल्टी-प्लेन:2,000 नोड्स से अधिक के क्लस्टर के लिए, वर्चुअल लेन और विभाजन कुंजियों के लिए स्विच के समर्थन का लाभ उठाते हुए, रूट-आधारित लोड संतुलन के साथ कई स्वतंत्र फैब्रिक्स (उदाहरण के लिए, 2× या 4× प्लेन) लागू करें।

विशिष्ट केबलिंग इंट्रा-रैक कनेक्शन (≤3 मीटर) के लिए ओएसएफपी-टू-ओएसएफपी डीएसी और 100 मीटर तक स्पाइन-लीफ दूरी के लिए ओएसएफपी-टू-400जी एसआर4 ऑप्टिकल मॉड्यूल का उपयोग करती है।MQM9790-NS2F संगतट्रांससीवर्स को NVIDIA के ऑप्टिकल विक्रेता पारिस्थितिकी तंत्र के साथ मान्य किया गया है, जो निर्बाध अंतरसंचालनीयता सुनिश्चित करता है।

5. संचालन, निगरानी, ​​दोष निदान और अनुकूलन

उत्पादन में कम विलंबता बनाए रखने के लिए प्रभावी संचालन महत्वपूर्ण हैं। समाधान के साथ एकीकृत होता हैNVIDIA UFM (यूनिफाइड फैब्रिक मैनेजर), जो प्रदान करता है:

  • वास्तविक समय डैशबोर्ड- प्रति-पोर्ट बैंडविड्थ, त्रुटि काउंटर और कंजेशन हीटमैप।
  • स्वचालित पथ पुनः अनुकूलन- जब कोई लिंक ख़राब या विफल हो जाता है, तो यूएफएम मार्गों की पुनर्गणना करता है और ऑपरेटर के हस्तक्षेप के बिना अनुकूली रूटिंग तालिकाओं को पुन: कॉन्फ़िगर करता है।
  • ऐतिहासिक टेलीमेट्री- पोस्टमार्टम विश्लेषण और क्षमता योजना के लिए विलंबता और प्रवाह डेटा संग्रहीत करता है।

अनुशंसित समस्या निवारण वर्कफ़्लो:

  1. प्रति-पोर्ट पॉज़ फ़्रेम और डिस्कार्ड की निगरानी करें - शून्य डिस्कार्ड अपेक्षित है; कोई भी त्याग गलत कॉन्फ़िगरेशन या दोषपूर्ण प्रकाशिकी का संकेत देता है।
  2. UFM के सामूहिक आँकड़ों के माध्यम से SHARPv3 ऑपरेशन को मान्य करें - सुनिश्चित करें कि कटौती संचालन को ऑफलोड किया गया है।
  3. अंतर्निहित डायग्नोस्टिक टूल का उपयोग करें (उदाहरण के लिए,ibdiagnet,ibstatus) लिंक अखंडता और सिग्नल अखंडता की जांच करने के लिए।

अनुकूलन के लिए, कार्यभार पैटर्न के आधार पर अनुकूली रूटिंग एल्गोरिदम थ्रेशोल्ड (उदाहरण के लिए, लोड-सेंसिंग अंतराल) को समायोजित करें -MQM9790-NS2F इनफिनीबैंड स्विचप्रबंधन इंटरफ़ेस के माध्यम से फ़ाइन-ट्यूनिंग की अनुमति देता है। नियमित फर्मवेयर अपडेट (एनवीआईडीआईए के समर्थन पोर्टल के माध्यम से उपलब्ध) में प्रदर्शन संवर्द्धन और सुरक्षा पैच शामिल हैं।

6. सारांश एवं मूल्य मूल्यांकन

मेलानॉक्स (NVIDIA मेलानॉक्स) MQM9790-NS2Fआरडीएमए/एचपीसी/एआई क्लस्टरों के लिए भविष्य-प्रूफ, उच्च-प्रदर्शन आधार प्रदान करता है। 400 जीबी/एस एनडीआर गति, 64‑पोर्ट घनत्व और बुद्धिमान इन‑नेटवर्क कंप्यूटिंग के संयोजन से, यह पारंपरिक बाधाओं को समाप्त करता है और एक्सास्केल क्लास तक रैखिक स्केलेबिलिटी प्रदान करता है। समाधान प्रति पोर्ट कम बिजली (≈1.5 डब्ल्यू), सरलीकृत केबलिंग और शार्प ऑफलोड से कम सीपीयू ओवरहेड के माध्यम से स्वामित्व की कुल लागत को कम करता है।

का मूल्यांकन करने वाले संगठनों के लिएMQM9790-NS2F कीमतनिवेश को GPU उपयोग में मापने योग्य लाभ (अक्सर उत्पादन में 90% से अधिक) और RoCEv2 फैब्रिक की तुलना में कार्य पूरा होने के समय में 40% तक की कमी द्वारा उचित ठहराया जाता है।MQM9790-NS2F डेटाशीटऔरMQM9790-NS2F विशिष्टताएँव्यापक विवरण प्रदान करें, और इकाइयाँ आसानी से उपलब्ध हैं (बिक्री के लिए MQM9790-NS2Fअधिकृत चैनलों के माध्यम से)। इसके अलावा, मौजूदा NVIDIA एडेप्टर के साथ स्विच की अनुकूलता मेलानॉक्स पारिस्थितिकी तंत्र में पहले से ही निवेश किए गए उपयोगकर्ताओं के लिए एक सहज माइग्रेशन पथ सुनिश्चित करती है।

संक्षेप में, यह तकनीकी समाधान पर आधारित हैMQM9790-NS2F इनफिनीबैंड स्विचएक मजबूत, परिचालन रूप से कुशल फैब्रिक प्रदान करता है जो सबसे अधिक मांग वाली कम-विलंबता इंटरकनेक्ट आवश्यकताओं को पूरा करता है - एआई सुपरकंप्यूटिंग की अगली पीढ़ी के लिए आधारशिला।