अनुप्रयोग अभ्यासः NVIDIA Mellanox MCX631102AN-ADAT RDMA/RoCE कम विलंबता परिवहन और सर्वर थ्रूपुट वृद्धि

April 27, 2026

के बारे में नवीनतम कंपनी की खबर अनुप्रयोग अभ्यासः NVIDIA Mellanox MCX631102AN-ADAT RDMA/RoCE कम विलंबता परिवहन और सर्वर थ्रूपुट वृद्धि

वितरित स्टोरेज, उच्च-प्रदर्शन कंप्यूटिंग और एआई प्रशिक्षण क्लस्टर में, नेटवर्क विलंबता और सीपीयू ओवरहेड सर्वर प्रदर्शन को सीमित करने वाले प्राथमिक बाधाएं बन गए हैं। एक क्लाउड सेवा प्रदाता ने हाल ही में अपने एनवीएमई-ओएफ स्टोरेज बैकएंड को चुनकर अपग्रेड किया है NVIDIA Mellanox MCX631102AN-ADAT सर्वर एडॉप्टर। कन्वर्ज्ड ईथरनेट (RoCEv2) पर आरडीएमए को तैनात करके, उन्होंने एंड-टू-एंड कम-विलंबता परिवहन और महत्वपूर्ण सर्वर थ्रूपुट लाभ प्राप्त किए। यह केस स्टडी जांच करती है कि एडॉप्टर उत्पादन वातावरण में कैसा प्रदर्शन करता है।

पृष्ठभूमि और चुनौती: टीसीपी/आईपी प्रोटोकॉल स्टैक बाधा

प्रदाता के मौजूदा 25GbE बुनियादी ढांचे ने पारंपरिक टीसीपी/आईपी सॉफ्टवेयर स्टैक का उपयोग करके स्टोरेज ट्रैफिक को संभाला। एनवीएमई/टीसीपी परिदृश्यों में, पैकेट एनकैप्सुलेशन और डी-एनकैप्सुलेशन के लिए सीपीयू उपयोग 40% से अधिक हो गया, जिसके परिणामस्वरूप 200µs से अधिक स्टोरेज विलंबता और एप्लिकेशन सर्वर पर कंप्यूट क्षमता में गंभीर कमी आई। आर्किटेक्ट्स को तत्काल एक ऐसे समाधान की आवश्यकता थी जो कर्नेल नेटवर्क स्टैक को बायपास कर सके, सीपीयू हस्तक्षेप को कम कर सके, और डुअल 25GbE लिंक पर लाइन-रेट थ्रूपुट बनाए रख सके। कई विकल्पों का मूल्यांकन करने के बाद, उन्होंने चुनाMCX631102AN-ADAT ConnectX-6 Lx डुअल-पोर्ट 25GbE SFP28 उनके स्टोरेज फैब्रिक नवीनीकरण के लिए मुख्य हार्डवेयर के रूप में।

समाधान और परिनियोजन: हार्डवेयर ऑफलोड के साथ आरडीएमए/RoCEv2

परिनियोजन ने सभी स्टोरेज-फेसिंग सर्वर को बदल दियाMCX631102AN-ADAT ईथरनेट एडॉप्टर कार्ड, RoCEv2 लॉसलेस मोड (ECN और PFC का उपयोग करके) में चल रहा है। प्रमुख परिनियोजन चरणों में शामिल हैं:

  • एसआर-आईओवी को सक्षम करना और स्टोरेज वर्चुअल मशीनों को वर्चुअल फ़ंक्शन (वीएफ) समर्पित करना, हाइपरवाइजर नेटवर्क स्टैक को बायपास करना
  • आरडीएमए ट्रांसपोर्ट के साथ एनवीएमई ओवर फैब्रिक्स (एनवीएमई-ओएफ) को कॉन्फ़िगर करना, टीसीपी ओवरहेड को पूरी तरह से समाप्त करना
  • लीफ-स्पाइन टोपोलॉजी पर लॉसलेस 25GbE RoCE ट्रैफिक के लिए स्विच बफर थ्रेसहोल्ड को ट्यून करना

TheMCX631102AN-ADAT विनिर्देश— जिसमें हार्डवेयर टाइमस्टैम्प, डायनामिक कनेक्शन ट्रांसपोर्ट (डीसीटी), और वैक्टरिज़्ड रिसीव इंजन शामिल हैं — 50Gbps एग्रीगेट लोड के तहत भी अनुमानित सब-माइक्रोसेकंड विलंबता सुनिश्चित करने के लिए पूरी तरह से उपयोग किए गए थे।

मापा गया प्रदर्शन लाभ और परिचालन लाभ

The पर माइग्रेट करने के बादNVIDIA Mellanox MCX631102AN-ADAT-आधारित फैब्रिक, निम्नलिखित मेट्रिक्स कैप्चर किए गए थे:

मीट्रिक पहले (टीसीपी/आईपी 25GbE) बाद में (MCX631102AN-ADAT के साथ RoCEv2)
एनवीएमई-ओएफ रीड लेटेंसी (P99) 215 µs 18 µs
सीपीयू उपयोग (स्टोरेज आई/ओ पाथ) 41% (सिंगल कोर संतृप्त) 7% (कोर में वितरित)
एग्रीगेट सर्वर थ्रूपुट (आरएक्स+टीएक्स) 42 Gbps (सॉफ्टवेयर सीमित) 49.8 Gbps (लाइन रेट)
छोटे पैकेट (64B) थ्रूपुट 8.1 Mpps 37.5 Mpps (हार्डवेयर फ्लो स्टीयरिंग)

इंजीनियरों ने नोट किया किMCX631102AN-ADAT ईथरनेट एडॉप्टर कार्ड समाधान ने रियल-टाइम एनालिटिक्स डेटाबेस के लिए उपयुक्त अनुमानित टेल लेटेंसी प्रदान की। इसके अतिरिक्त, मुक्त सीपीयू कोर को एप्लिकेशन वर्कलोड में पुन: असाइन किया गया, जिससे समान भौतिक सर्वर पर लगभग 24% की समग्र टेनेंट घनत्व में वृद्धि हुई।

संगतता और पारिस्थितिकी तंत्र एकीकरण

परिनियोजन का विस्तार करते समय, संचालन टीम ने सत्यापित किया कि एडॉप्टर हैMCX631102AN-ADAT संगत उनके मौजूदा एनवीडिया स्पेक्ट्रम स्विच (लॉसलेस RoCE प्रोफाइल) के साथ-साथ अरिस्टा और सिस्को से तीसरे पक्ष के टीओआर स्विच के साथ डीसीबीएक्स कॉन्फ़िगरेशन के साथ। खरीद योजना के लिए, उन्होंने संदर्भ लियाMCX631102AN-ADAT डेटाशीट पावर एनवेलोप (लगभग 12W विशिष्ट) और थर्मल आवश्यकताओं को मान्य करने के लिए। प्रारंभिक थोक पूछताछ की पुष्टि की गई किMCX631102AN-ADAT मूल्य समान-वर्ग स्मार्टएनआईसी की तुलना में प्रतिस्पर्धी बना हुआ है, जिसमें कई वितरक सूचीबद्ध हैंMCX631102AN-ADAT बिक्री के लिएमानक मात्रा समझौतों के तहत।

सारांश और आउटलुक

उत्पादन मामला स्पष्ट रूप से प्रदर्शित करता है किMCX631102AN-ADAT टीसीपी-बाउंड स्टोरेज नेटवर्क से आरडीएमए-त्वरित फैब्रिक में एक मौलिक बदलाव को सक्षम बनाता है, जिसके लिए 100GbE बुनियादी ढांचे के पूर्ण ओवरहाल की आवश्यकता नहीं होती है। का लाभ उठाकरMCX631102AN-ADAT ConnectX-6 Lx डुअल-पोर्ट 25GbE SFP28 डिजाइन, संगठन विलंबता-संवेदनशील वर्कलोड के लिए प्रभावी थ्रूपुट को दोगुना कर सकते हैं जबकि महत्वपूर्ण सीपीयू संसाधनों को पुनः प्राप्त कर सकते हैं। आगे देखते हुए, वही परिनियोजन पैटर्न वितरित मशीन लर्निंग फ्रेमवर्क (एनसीसीएल ओवर RoCE) और माइक्रोसेवा-आधारित स्टेटफुल अनुप्रयोगों तक विस्तारित होगा। 25GbE अपग्रेड का मूल्यांकन करने वाले आर्किटेक्ट्स के लिए,NVIDIA Mellanox MCX631102AN-ADAT उच्च-प्रदर्शन, कम-विलंबता डेटा सेंटर नेटवर्क के लिए एक सिद्ध, उत्पादन-कठोर निर्माण खंड के रूप में खड़ा है।