অ্যাকশনে NVIDIA Mellanox MCX556A-ECAT সার্ভার অ্যাডাপ্টার | RDMA/RoCE লো-লেটেন্সি ট্রান্সপোর্ট ও সার্ভার থ্রুপুট বৃদ্ধি
July 23, 2026
NVIDIA Mellanox MCX556A-ECAT সার্ভার অ্যাডাপ্টার অ্যাকশনে | RDMA/RoCE লো-লেটেন্সি ট্রান্সপোর্ট ও সার্ভার থ্রুপুট বৃদ্ধি
পটভূমি ও চ্যালেঞ্জ: যখন 100GbE লেটেন্সি ওয়ালের মুখোমুখি হয়
একটি শীর্ষস্থানীয় কোয়ান্টেটিভ ট্রেডিং ফার্ম — আসুন তাদের "AlphaQuant" বলি — একটি গুরুতর পরিকাঠামোগত সংকটের সম্মুখীন হচ্ছিল। তাদের হাই-ফ্রিকোয়েন্সি ট্রেডিং (HFT) প্ল্যাটফর্ম, যা প্রতি সেকেন্ডে ২ মিলিয়নেরও বেশি মার্কেট মেসেজ প্রক্রিয়া করত, সেখানে অপ্রত্যাশিত লেটেন্সি স্পাইক দেখা দিচ্ছিল যা সরাসরি P&L-কে প্রভাবিত করছিল। ফার্মটি ইতিমধ্যেই 100GbE নেটওয়ার্কিং-এ আপগ্রেড করেছিল, কিন্তু তাদের বিদ্যমান সার্ভার অ্যাডাপ্টারগুলি তাল মেলাতে পারছিল না। TCP/IP স্ট্যাক তাদের ট্রেডিং সার্ভারগুলিতে ৩০% এর বেশি CPU কোর ব্যবহার করছিল এবং সফ্টওয়্যার-ভিত্তিক নেটওয়ার্কিং স্ট্যাক এমন জিটার তৈরি করছিল যা ধারাবাহিক সাব-১০µs রাউন্ড-ট্রিপ টাইম অর্জন করা অসম্ভব করে তুলেছিল। তাদের স্টোরেজ ব্যাকএন্ড, যা iSCSI-এর উপর NVMe অ্যারে চালাচ্ছিল, সেটিও কম পারফর্ম করছিল, যেখানে রিড লেটেন্সি ১৫০µs ছাড়িয়ে যাচ্ছিল — রিয়েল-টাইম রিস্ক ক্যালকুলেশনের জন্য এটি অনেক ধীর ছিল। AlphaQuant-এর নেটওয়ার্ক I/O আর্কিটেকচারের একটি আমূল পুনর্গঠনের প্রয়োজন ছিল।
তাদের অনুসন্ধান তাদের নিয়ে আসে NVIDIA Mellanox MCX556A-ECAT — একটি সার্ভার অ্যাডাপ্টার যা সবচেয়ে লেটেন্সি-সংবেদনশীল পরিবেশের জন্য তৈরি করা হয়েছে। ফার্মের আর্কিটেকচার টিম বুঝতে পেরেছিল যে MCX556A-ECAT ConnectX অ্যাডাপ্টার PCIe নেটওয়ার্ক কার্ড হার্ডওয়্যার অফলোড এবং RDMA ক্ষমতা সরবরাহ করে যা সফ্টওয়্যার স্ট্যাকের বাধা দূর করার জন্য প্রয়োজনীয়।
সমাধান: MCX556A-ECAT ইথারনেট অ্যাডাপ্টার কার্ড স্থাপন
AlphaQuant ৮০টি ট্রেডিং সার্ভারে MCX556A-ECAT ইথারনেট অ্যাডাপ্টার কার্ড স্থাপন করেছে, প্রতিটি ডুয়াল QSFP28 পোর্ট সহ একটি লিফ-স্পাইন 100GbE ফ্যাব্রিকের সাথে সংযুক্ত। এই স্থাপনাটি ট্রেডিং ডেটা এবং স্টোরেজ ট্র্যাফিক উভয়ের জন্য লসলেস ইথারনেট ট্রান্সপোর্ট সক্ষম করতে অ্যাডাপ্টারের নেটিভ RoCE v2 সমর্থন ব্যবহার করেছে। সমাধানের মূল বিষয় ছিল কনভার্জড ইথারনেটের উপর RDMA চালানোর অ্যাডাপ্টারের ক্ষমতা, যা একটি পৃথক ইনফিনিব্যান্ড নেটওয়ার্কের প্রয়োজনীয়তা দূর করে। দলটি সুইচ স্তরে PFC (Priority Flow Control) এবং ECN (Explicit Congestion Notification) কনফিগার করেছে, ট্রেডিং ট্র্যাফিকের জন্য প্রায়োরিটি ৩ এবং স্টোরেজের জন্য প্রায়োরিটি ৪ উৎসর্গ করেছে। তিন সপ্তাহের মধ্যে, সম্পূর্ণ ট্রেডিং এবং স্টোরেজ ফ্যাব্রিক RDMA-তে চলছিল — অ্যাডাপ্টারের বিদ্যমান লিনাক্স-ভিত্তিক পরিবেশের সাথে বিস্তৃত সামঞ্জস্যের কারণে এই পরিবর্তনটি নির্বিঘ্ন ছিল।
অপারেশনাল দৃষ্টিকোণ থেকে, MCX556A-ECAT সামঞ্জস্যপূর্ণ ইকোসিস্টেম অমূল্য প্রমাণিত হয়েছে। কার্ডগুলি AlphaQuant-এর Dell PowerEdge সার্ভার এবং Arista সুইচগুলির সাথে ত্রুটিহীনভাবে সংহত হয়েছে, শুধুমাত্র স্ট্যান্ডার্ড NVIDIA ড্রাইভার ইনস্টলেশনের প্রয়োজন হয়েছে। দলটি MCX556A-ECAT ডেটাশিট উল্লেখ করেছে তাদের মিশ্র ওয়ার্কলোড পরিবেশের জন্য — যার মধ্যে মার্কেট ডেটা ইনজেশন, অর্ডার এক্সিকিউশন এবং রিয়েল-টাইম রিস্ক অ্যানালিটিক্স অন্তর্ভুক্ত ছিল — সর্বোত্তম পারফরম্যান্স অর্জনের জন্য বাফার বরাদ্দ এবং ইন্টারাপ্ট কোয়ালিসিং সেটিংস ফাইন-টিউন করতে।
পরিমাপযোগ্য ফলাফল: লেটেন্সি, থ্রুপুট এবং CPU দক্ষতা
পারফরম্যান্স বৃদ্ধি তাৎক্ষণিক এবং পরিমাপযোগ্য ছিল। NVIDIA Mellanox MCX556A-ECAT এর মাধ্যমে RoCE-এর উপর RDMA সক্ষম করার সাথে সাথে, ট্রেডিং অ্যাপ্লিকেশনটি এন্ড-টু-এন্ড লেটেন্সি গড় ৪২µs থেকে মাত্র ৬.৫µs-এ নেমে আসতে দেখেছে — একটি ৬.৫x উন্নতি। জিটার (স্ট্যান্ডার্ড ডেভিয়েশন) ±১৮µs থেকে ±১.২µs-এর নিচে নেমে এসেছে, যা ট্রেডিং ডেস্ককে লাভজনক এক্সিকিউশনের জন্য প্রয়োজনীয় ডিটারমিনিজম দিয়েছে। তাদের স্টোরেজ ব্যাকএন্ডের জন্য, NVMe-oF রিড লেটেন্সি ১৫২µs থেকে ১৮µs-এর নিচে নেমে এসেছে — একটি ৮x উন্নতি যা রিস্ক ক্যালকুলেশনকে ৭০% দ্রুত করেছে।
লেটেন্সি ছাড়াও, সার্ভার থ্রুপুট বৃদ্ধি সমানভাবে আকর্ষণীয় ছিল। হার্ডওয়্যার অফলোড ইঞ্জিন — যার মধ্যে চেকসাম অফলোড, LSO/LRO এবং VLAN ট্যাগিং অন্তর্ভুক্ত — সমস্ত সার্ভারে নেটওয়ার্ক প্রসেসিংয়ের জন্য CPU ব্যবহার ৩২% থেকে ৫%-এর নিচে কমিয়ে এনেছে। এটি ট্রেডিং অ্যালগরিদমের জন্য প্রতি সার্ভারে ২৪টি CPU কোর মুক্ত করেছে, সরাসরি অর্ডার থ্রুপুট ১.২ মিলিয়ন থেকে ২.১ মিলিয়ন মেসেজ প্রতি সেকেন্ডে বাড়িয়েছে।
| মেট্রিক | আগে (লিগ্যাসি NIC) | পরে (MCX556A-ECAT) | উন্নতি |
|---|---|---|---|
| ট্রেডিং এন্ড-টু-এন্ড লেটেন্সি | ৪২ µs | ৬.৫ µs | ৬.৫x দ্রুত |
| লেটেন্সি জিটার (স্ট্যান্ডার্ড ডেভিয়েশন) | ±১৮ µs | ±১.২ µs | ১৫x বেশি ধারাবাহিক |
| NVMe-oF রিড লেটেন্সি | ১৫২ µs | ১৮ µs | ৮.৪x দ্রুত |
| CPU নেটওয়ার্ক ওভারহেড | ৩২% | ৪.৮% | ৮৭% কম |
| অর্ডার থ্রুপুট | ১.২M msg/s | ২.১M msg/s | ৭৫% বেশি |
অপারেশনাল সুবিধা: TCO এবং পরিকাঠামো একত্রীকরণ
যদিও কাঁচা পারফরম্যান্স সংখ্যা একটি আকর্ষণীয় গল্প বলে, অপারেশনাল লাভও সমানভাবে গুরুত্বপূর্ণ ছিল। MCX556A-ECAT ইথারনেট অ্যাডাপ্টার কার্ড সমাধান একটি পৃথক RDMA ফ্যাব্রিকের প্রয়োজনীয়তা দূর করে মোট মালিকানা ব্যয় হ্রাস করেছে (সুইচ পরিকাঠামোতে $350K এর বেশি সাশ্রয়)। প্রতি সার্ভারে পাওয়ার খরচ পূর্ববর্তী NIC-এর তুলনায় 8W কমেছে, যা বার্ষিক কুলিং সাশ্রয়ে প্রায় 20% অনুবাদ করেছে। অতিরিক্তভাবে, অ্যাডাপ্টারের ডুয়াল-পোর্ট ডিজাইন নেটিভ রিডান্ডেন্সি সরবরাহ করেছে — যখন একটি লিঙ্ক ফ্ল্যাপ করছিল, তখন অ্যাডাপ্টারের টেলিমেট্রি লগ দ্বারা যাচাই করা শূন্য প্যাকেট লস সহ ট্র্যাফিক স্বয়ংক্রিয়ভাবে সেকেন্ডারি পোর্টে ফেইলওভার হয়েছিল।
যারা MCX556A-ECAT মূল্য বিকল্প সমাধানের সাথে তুলনা করে মূল্যায়ন করছেন, AlphaQuant-এর পরিকাঠামো প্রধান উল্লেখ করেছেন যে পরিশোধের সময়কাল আট মাসের কম ছিল, যা মূলত বর্ধিত ট্রেডিং থ্রুপুট এবং হ্রাসকৃত লেটেন্সি পেনাল্টি দ্বারা চালিত হয়েছিল। দলটি ভবিষ্যতের জন্য প্রস্তুত আর্কিটেকচারকেও প্রশংসা করেছে — একই MCX556A-ECAT বিক্রয়ের জন্য আজ 100GbE সমর্থন করে তবে উপযুক্ত অপটিক্স সহ 40GbE বা 50GbE-তেও চলতে পারে, ভবিষ্যতের আপগ্রেডের জন্য বিনিয়োগ সুরক্ষা নিশ্চিত করে।
অনুসারে, MCX556A-ECAT স্পেসিফিকেশন অ্যাডাপ্টারে উন্নত টেলিমেট্রি বৈশিষ্ট্য অন্তর্ভুক্ত রয়েছে — প্রতি-পোর্ট প্যাকেট কাউন্টার, ত্রুটি পরিসংখ্যান এবং তাপমাত্রা পর্যবেক্ষণ — যা AlphaQuant তাদের Prometheus/Grafana স্ট্যাকের সাথে নেটিভভাবে সংহত করেছে। এটি ট্রেডিং পারফরম্যান্সকে প্রভাবিত করার আগে কেবল অবনতি এবং সুইচ কনজেশন সনাক্তকরণ সক্ষম করেছে।
সারসংক্ষেপ ও পূর্বাভাস: আল্ট্রা-লো-লেটেন্সি পরিকাঠামোর জন্য একটি ব্লুপ্রিন্ট
AlphaQuant-এর NVIDIA Mellanox MCX556A-ECAT এর সাথে যাত্রা 100GbE পরিকাঠামোর সম্পূর্ণ সম্ভাবনা উন্মোচন করতে চাওয়া সংস্থাগুলির জন্য একটি স্পষ্ট ব্লুপ্রিন্ট প্রদর্শন করে। ডুয়াল-পোর্ট 100GbE থ্রুপুট, হার্ডওয়্যার-ত্বরান্বিত RoCE এবং বিদ্যমান ইকোসিস্টেমগুলির সাথে নির্বিঘ্ন সংহতকরণকে একত্রিত করে, MCX556A-ECAT ইথারনেট অ্যাডাপ্টার কার্ড নেটওয়ার্ক I/O কে পারফরম্যান্স বাধা থেকে প্রতিযোগিতামূলক সুবিধায় রূপান্তরিত করে। ফলাফল — ৬.৫x কম লেটেন্সি, ৮৭% CPU ওভারহেড হ্রাস এবং ৭৫% বেশি অর্ডার থ্রুপুট — সবচেয়ে চাহিদাপূর্ণ পরিবেশে পরিমাপযোগ্য ব্যবসায়িক ফলাফল প্রদানের অ্যাডাপ্টারের ক্ষমতাকে নির্দেশ করে।
সামনে তাকিয়ে, যেহেতু AI/ML ওয়ার্কলোড এবং রিয়েল-টাইম অ্যানালিটিক্স ডিটারমিনিস্টিক নেটওয়ার্কিংয়ের চাহিদা বাড়িয়ে চলেছে, MCX556A-ECAT ConnectX অ্যাডাপ্টার PCIe নেটওয়ার্ক কার্ড ফোর্কলিফ্ট আপগ্রেড ছাড়াই RDMA গ্রহণের জন্য একটি শক্তিশালী ভিত্তি সরবরাহ করে। তাদের পরবর্তী পরিকাঠামো রিফ্রেশ পরিকল্পনা করা স্থপতি এবং আইটি নেতাদের জন্য, এই অ্যাডাপ্টারটি কেবল একটি উপাদান নয়, একটি কৌশলগত সম্পদ। বিস্তারিত টিউনিং প্যারামিটার এবং স্থাপনার সেরা অনুশীলনগুলি অফিসিয়াল MCX556A-ECAT ডেটাশিট — যেকোনো গুরুতর স্থাপনার জন্য একটি অপরিহার্য রেফারেন্স — এ উপলব্ধ।

