ChatGPT, Claude ও Grok একসঙ্গে থেমেছিল—এক cloud-কে এখনই দোষ নয়

৩ সেপ্টেম্বর ২০২৬-এ ChatGPT, Claude ও Grok একই সময়সীমার মধ্যে পরিষেবা-বিঘ্নের মুখে পড়েছিল। OpenAI, Anthropic ও xAI-এর পৃথক নথিতে সমস্যাগুলো নিশ্চিত হয়েছে; তিনটি সংশ্লিষ্ট incident-ই পরে resolved হয়েছে।
তবে একই সময়ে সমস্যা হওয়া মানেই একই কারণে সমস্যা হওয়া নয়। প্রকাশিত status update-গুলোর কোনোটিই একটি অভিন্ন cloud provider, region বা network dependency-কে তিন পরিষেবার ব্যর্থতার কারণ হিসেবে শনাক্ত করেনি। তাই এখন পর্যন্ত নিশ্চিত সিদ্ধান্ত হলো: outage-গুলোর সময় আংশিকভাবে মিলে গিয়েছিল, কিন্তু common cloud failure-এর দাবি প্রমাণিত নয়।
ChatGPT-এ কী ঘটেছিল

OpenAI-এর incident record ৩ সেপ্টেম্বর ChatGPT ও Codex-এ elevated error নথিভুক্ত করেছে। প্রথম update-এ প্রতিষ্ঠানটি তালিকাভুক্ত পরিষেবাগুলোর সমস্যা তদন্ত করার কথা জানায়; পরে mitigation প্রয়োগ করে recovery পর্যবেক্ষণ করা হয় এবং শেষ update-এ incident resolved ঘোষণা করা হয়।
নথিটিতে ChatGPT-এর ১৫টি এবং Codex-এর চারটি component affected হিসেবে দেখানো হয়েছে। সমাধানের পর কিছু Codex remote control ব্যবহারকারীকে মোবাইল ডিভাইস আবার pair করতে হতে পারে বলেও সেখানে উল্লেখ আছে।
এই তথ্য “ChatGPT থেমেছিল” কথাটির সীমা স্পষ্ট করে। ঘটনাটি পুরো পরিষেবা প্রত্যেক ব্যবহারকারীর জন্য একইভাবে অচল হয়ে যাওয়ার প্রমাণ নয়; এটি একাধিক component-এ error বেড়ে যাওয়া এবং degraded performance-এর incident। OpenAI নিজেও বলে, তার availability metric সব tier, model ও error type মিলিয়ে aggregate পর্যায়ে দেখানো হয়—তাই ব্যক্তিভেদে প্রভাব আলাদা হতে পারে।
Claude-এ একাধিক model আক্রান্ত হয়েছিল

Claude-এর official status history ৩ সেপ্টেম্বর দুটি সংশ্লিষ্ট incident দেখায়। Claude Sonnet 5-এ elevated error-এর তদন্ত শুরু হয় ১২:৩৭ UTC-তে এবং সেটি ১২:৫৬ UTC-তে resolved হয়; এরপর ১৩:২৬ UTC থেকে অন্য একাধিক model-এ elevated error তদন্ত করা হয়।
দ্বিতীয় incident-এ affected model-এর তালিকায় Mythos/Fable 5.1, Mythos/Fable 5, Opus 5, Opus 4.8 ও Opus 4.6 ছিল। Anthropic-এর update অনুযায়ী, recovery ধাপে ধাপে ঘটে: ১৫:২৫ UTC-তে শুধু Opus 4.8 ও Opus 5 আক্রান্ত ছিল, অন্য model-গুলোর error rate baseline-এ ফিরেছিল। Fix deploy করার পর প্রভাব ১৬:১৬ UTC-তে শেষ হয় এবং ১৬:২৩ UTC-তে resolution update প্রকাশিত হয়।
সুতরাং Claude-এর ক্ষেত্রেও “পুরো platform একটানা বন্ধ” বলা অতিরঞ্জিত হবে। প্রমাণিত তথ্য হলো, নির্দিষ্ট সময়ে একাধিক Claude model-এ request error বেড়েছিল এবং model-গুলো পর্যায়ক্রমে স্বাভাবিক অবস্থায় ফিরেছিল। বর্তমানে status page-এ তালিকাভুক্ত Claude পরিষেবাগুলো operational।
Grok-এর সমস্যা user report-এ সীমাবদ্ধ ছিল না

xAI-এর Grok in X record ঘটনাটিকে “Models outage” হিসেবে চিহ্নিত করেছে। ৩ সেপ্টেম্বর ১৩:৩০ UTC-তে তদন্ত শুরু হয়; ১৭:০৫ UTC-তে xAI জানায়, পরিস্থিতি resolved এবং traffic আবার healthy। নথিভুক্ত incident-এর স্থায়িত্ব ছিল ৩ ঘণ্টা ৩৫ মিনিট।
এই primary record Grok-এর বিঘ্নকে কেবল ব্যবহারকারীর অভিযোগ বা তৃতীয় পক্ষের outage counter-এর ফল হিসেবে দেখার সুযোগ রাখে না। তবে এর আওতা নির্দিষ্ট: affected component ছিল Grok in X। একই সময়ে Grok-এর web, mobile app এবং API-ও সমানভাবে ব্যর্থ হয়েছিল—এই record থেকে এমন সিদ্ধান্ত নেওয়া যায় না।
Claude-এর বহু-model incident ১৩:২৬ থেকে ১৬:১৬ UTC পর্যন্ত চলেছে, আর Grok in X outage চলেছে ১৩:৩০ থেকে ১৭:০৫ UTC পর্যন্ত। OpenAI-এর ChatGPT–Codex incident-এর investigation, mitigation ও resolution update-ও এই যৌথ সময়সীমার মধ্যে পড়ে। এই overlap-ই শিরোনামের “একসঙ্গে” কথাটিকে সমর্থন করে; তিনটি ঠিক একই মুহূর্তে শুরু হয়েছিল বা একই সময় ধরে চলেছিল—এমন দাবি নয়।
এক cloud-কে এখনই দোষ দেওয়া যাচ্ছে না
সময়ের মিল একটি shared infrastructure failure-এর সম্ভাবনা তৈরি করতে পারে, কিন্তু নিজে থেকে কারণ প্রমাণ করে না। কাছাকাছি সময়ে পৃথক software deployment, capacity pressure, model-serving failure, network route বা আলাদা upstream dependency থেকেও একাধিক incident ঘটতে পারে।
প্রকাশিত তিন record-এর কোনোটিই একই cloud provider, data-center region বা network component-এর নাম দেয়নি। OpenAI তার public update-এ investigation ও mitigation-এর কথা বলেছে; Anthropic কারণ শনাক্ত করে fix দেওয়ার কথা বললেও অন্য provider-এর সঙ্গে কোনো যোগসূত্র দেখায়নি; xAI-ও traffic পুনরুদ্ধারের কথা জানিয়েছে, কিন্তু shared cloud failure-এর attribution দেয়নি।
এখানে প্রমাণের তিনটি স্তর আলাদা। Provider status record নির্দিষ্ট service disruption নিশ্চিত করে; user report কোনো ব্যবহারকারী কী লক্ষণ দেখেছেন তা জানায়; আর shared dependency হলো সম্ভাব্য causal explanation। প্রথম দুই স্তরের তথ্য দিয়ে তৃতীয় স্তরের সিদ্ধান্ত নিশ্চিত করা যায় না।
যা নিশ্চিত, যা এখনও অজানা
নিশ্চিত তথ্য হলো, ৩ সেপ্টেম্বর ChatGPT ও Codex-এ elevated error, একাধিক Claude model-এ elevated error এবং Grok in X-এ models outage ঘটেছিল। সংশ্লিষ্ট তিন incident-ই resolved, এবং প্রকাশিত বর্তমান status-এ সেগুলো চলমান সমস্যা হিসেবে দেখানো হচ্ছে না।
অজানা রয়ে গেছে root cause-গুলো পরস্পরের সঙ্গে যুক্ত ছিল কি না। Provider-রা বিস্তারিত post-incident analysis প্রকাশ করলে dependency, failure domain ও ঘটনার ক্রম তুলনা করা যাবে। তার আগে সবচেয়ে নির্ভুল বর্ণনা হলো—একই সময়সীমায় তিনটি পৃথকভাবে নিশ্চিত disruption ঘটেছিল; একটি cloud তিনটিরই পতন ঘটিয়েছে, এমন সিদ্ধান্ত এখনো তথ্যের চেয়ে অনুমান বেশি।
আরও পড়ুন:
আমাদের নিউজলেটার নিন
সর্বশেষ Web3, AI ও ক্রিপ্টো সংবাদ সরাসরি আপনার ইনবক্সে পান।