এআই ও অটোমেশন

Cisco-র AI Factory এখন rack-scale: অক্টোবরেই Supermicro compute

|লেখক: QUASA সম্পাদকীয় দল|4 মিনিটের পাঠ| 12
Cisco-র AI Factory এখন rack-scale: অক্টোবরেই Supermicro compute

Cisco ২৫ আগস্ট ২০২৬ Secure AI Factory with NVIDIA-কে rack-scale অবকাঠামো পর্যন্ত সম্প্রসারণের ঘোষণা দিয়েছে। Supermicro-র liquid ও air-cooled dense GPU system এতে compute ও cooling স্তর যোগ করবে; Cisco-র ঘোষণায় বলা হয়েছে, Supermicro compute solution অক্টোবর ২০২৬ থেকে দেওয়া শুরু হবে।

এটি আগস্টেই বাজারে পাওয়া যাচ্ছে—এমন ঘোষণা নয়। Axios-এর ২৫ আগস্টের প্রতিবেদন একই partnership, high-density liquid ও air-cooled system এবং অক্টোবরের প্রত্যাশিত availability নিশ্চিত করেছে। পরিবর্তনটির তাৎপর্য হলো, Cisco এখন networking-এর সঙ্গে compute, cooling, security ও observability-সহ pre-validated infrastructure বিক্রির পরিকল্পনা করছে।

Rack-scale সম্প্রসারণে যা যোগ হচ্ছে

Secure AI Factory with NVIDIA আগে থেকেই Cisco networking, NVIDIA AI infrastructure, security এবং management ও observability-র উপাদান এক architecture-এ রাখত। Supermicro যুক্ত হওয়ায় এর মধ্যে সম্পূর্ণ rack-scale system এবং HGX ও MGX architecture-ভিত্তিক dense GPU server আসছে। Liquid-cooled ও air-cooled—দুই ধরনের compute option রাখার পরিকল্পনা রয়েছে।

Liquid-cooled configuration-এ সীমাটি শুধু server পর্যন্ত নয়। Cisco-র liquid-cooled AI networking system এবং Supermicro-র liquid-cooled server একসঙ্গে rack-to-fabric cooling model তৈরি করবে। ঘোষিত platform support-এর মধ্যে NVIDIA Vera Rubin NVL72 ও NVIDIA HGX Rubin NVL8 আছে; Cisco এগুলোকে trillion-parameter model training ও high-throughput inference-এর মতো ভারী workload-এর জন্য অবস্থান দিচ্ছে।

Neocloud ও sovereign cloud operator-দের জন্য বিস্তৃত architecture-টি NVIDIA Cloud Partner-compliant solution হিসেবে দেওয়া হবে। Enterprise deployment-এর জন্যও NVIDIA-র নতুন প্রজন্মের AI infrastructure যুক্ত করে reference architecture সম্প্রসারণের পরিকল্পনা করেছে Cisco। তবে reference architecture মানেই নির্দিষ্ট site উৎপাদন ব্যবহারের জন্য প্রস্তুত নয়—বিদ্যুৎ, cooling, storage, Kubernetes platform ও installation validation প্রকল্পভেদে নির্ধারণ করতে হবে।

Compute, network ও operations-এর deployment map

AI workload-এর compute, NIC, optics ও Cisco network fabric-এর health একই operations view-তে পর্যবেক্ষণ করা হচ্ছে

Compute স্তরে Supermicro rack-scale system এবং HGX ও MGX-ভিত্তিক dense GPU server সরবরাহ করবে। এগুলো Cisco-র বৃহত্তর AI infrastructure portfolio-র অংশ হিসেবে validate ও বিক্রি করার পরিকল্পনা রয়েছে; ফলে server আলাদা পণ্য হিসেবে কিনে পরে network architecture-এর সঙ্গে মেলানোর বদলে একটি সমন্বিত নকশা পাওয়া যাবে।

Network স্তরে front-end fabric-এর জন্য Cisco Silicon One-ভিত্তিক switch এবং back-end AI fabric-এর জন্য NVIDIA Spectrum-X Ethernet silicon-ভিত্তিক Cisco switch থাকবে। Cisco Nexus One এই অংশগুলোকে unified networking architecture-এ আনবে। Storage network-ও নকশার একটি স্বতন্ত্র স্তর, আর storage ও Kubernetes platform আসবে Cisco-র ecosystem partner-দের কাছ থেকে।

Security ও observability স্তরে architecture-টিতে Cisco distributed security, Splunk observability এবং NVIDIA AI Enterprise software থাকার কথা। Cisco Cloud Control-এর AgenticOps ব্যবস্থায় AI job-এর health-এর সঙ্গে compute, NIC, optics ও network performance metric মিলিয়ে দেখার পরিকল্পনা রয়েছে। এতে fault GPU server, interface, optical link না network fabric-এ তৈরি হচ্ছে—operations team সেই স্তরগুলোকে একই পর্যবেক্ষণ পরিসরে বিশ্লেষণ করতে পারবে।

Validation ও service স্তরে Cisco Validated Infrastructure Services, NVIDIA Infrastructure Services-এর methodology-র সঙ্গে সামঞ্জস্য রেখে স্থাপিত infrastructure reference design অনুযায়ী তৈরি হয়েছে কি না তা যাচাই করবে। এ কাজের জন্য deployment tool ও software পরীক্ষা করতে Cisco একটি dedicated large-scale AI lab-এ বিনিয়োগ করছে। এটি ভবিষ্যৎ validation service; কোনো customer deployment-এর ইতিমধ্যে সম্পন্ন certification নয়।

কোন workload-এ rack-scale প্রয়োজন

ধারাবাহিক বৃহৎ training workload-এর rack-scale অবকাঠামো ও ছোট inference deployment-এর সক্ষমতার পার্থক্য

Rack-scale architecture প্রধানত সেই workload-এর জন্য প্রাসঙ্গিক, যেখানে একাধিক dense GPU system-এর মধ্যে দ্রুত সংযোগ, দীর্ঘ সময় উচ্চ utilization এবং facility-level cooling একসঙ্গে দরকার। বড় model training, উচ্চ-throughput shared inference, neocloud capacity এবং নির্দিষ্ট ভূখণ্ডে data রাখার শর্তযুক্ত sovereign cloud এই নকশার সম্ভাব্য ক্ষেত্র। এখানে pre-validated architecture আলাদা vendor-এর compute, switch, cooling ও management layer জোড়া দেওয়ার integration কাজ কমাতে পারে, যদিও deployment risk দূর করে না।

প্রতিটি enterprise AI project-এর জন্য rack-scale system প্রয়োজন হবে না। eWeek-এর ২৬ আগস্টের বিশ্লেষণ অনুযায়ী, সম্ভাব্য ক্রেতাকে utilization, power ও cooling upgrade এবং capital ও operating cost-এর বিপরীতে performance বিচার করতে হবে। সীমিত pilot, অনিয়মিত training job বা ছোট departmental inference-এর ক্ষেত্রে ছোট modular deployment কিংবা cloud capacity বেশি উপযোগী হতে পারে—এটি ঘোষিত performance result নয়, workload ও খরচের ভিত্তিতে নেওয়া deployment সিদ্ধান্ত।

বাংলাদেশ ও ভারতের enterprise data center-এর ক্ষেত্রে মূল প্রশ্ন শুধু GPU-র সংখ্যা নয়। বিদ্যমান facility dense rack-এর power ও thermal load নিতে পারবে কি না, workload নিয়মিত সেই capacity ব্যবহার করবে কি না এবং latency বা data-residency requirement স্থানীয় infrastructure বাধ্যতামূলক করছে কি না—এই তিনটি শর্ত rack-scale বিনিয়োগের যৌক্তিকতা নির্ধারণ করবে। Air-cooled option থাকলেও high-density system-এর power ও heat-management requirement বিলীন হয় না।

অক্টোবরের availability আসলে কী বোঝায়

Cisco-র পরিকল্পনা অনুযায়ী, অক্টোবর ২০২৬ থেকে authorized channel partner ecosystem-এর মাধ্যমে rack-scale architecture অর্ডার করা যাবে। একই সময় Supermicro-র liquid ও air-cooled dense GPU server-ও orderable হওয়ার কথা। তাই শিরোনামের অক্টোবরের সময়সীমা offering ও ordering শুরুর পরিকল্পনাকে বোঝায়; delivered, installed বা production-ready customer system-কে নয়।

সব configuration বা অঞ্চলে একই delivery date-এর প্রতিশ্রুতি প্রকাশ করা হয়নি। GPU, memory, CPU ও SSD সরবরাহ, data-center readiness, partner-provided storage ও Kubernetes platform এবং স্থানীয় deployment service প্রকল্পের সময়সূচি বদলাতে পারে। Cisco ও Supermicro তাদের supply-chain সক্ষমতাকে delivery risk কমানোর উপায় হিসেবে তুলে ধরেছে, কিন্তু নির্দিষ্ট lead time প্রকাশ করেনি।

ঘোষণায় price, অঞ্চলভিত্তিক rollout, configuration-specific bill of materials কিংবা customer deployment result নেই। ফলে বর্তমানে নিশ্চিত সীমাটি হলো: Cisco তার NVIDIA-ভিত্তিক architecture-এ Supermicro compute ও cooling এনে rack-scale পর্যন্ত বিস্তৃত করছে এবং অক্টোবর ২০২৬ থেকে তা offer ও orderable করার পরিকল্পনা করেছে। প্রকৃত delivery, installation, validated configuration এবং production workload-এর ফল পরবর্তী পর্যায়ে জানা যাবে।

শেয়ার করুন:

আমাদের নিউজলেটার নিন

সর্বশেষ Web3, AI ও ক্রিপ্টো সংবাদ সরাসরি আপনার ইনবক্সে পান।

0