ChatGPT, Claude và Grok cùng gián đoạn, nhưng chưa có bằng chứng lỗi chung

ChatGPT, Claude và Grok cùng gặp gián đoạn ngày 3/9/2026, trong những khoảng thời gian chồng lấn từ tối đến gần nửa đêm theo giờ Việt Nam. Cả ba sau đó đều phục hồi; bản đối chiếu của The Register xác nhận sự trùng thời điểm nhưng không tìm thấy dấu hiệu về sự cố liên quan trên các bảng trạng thái của Cloudflare, AWS, Google Cloud hay Microsoft Azure khi kiểm tra.
Dữ liệu công khai đến ngày 5/9 cho thấy đây là ba hồ sơ riêng: OpenAI nêu lỗi định tuyến, Anthropic chỉ nói đã xác định nguyên nhân rồi triển khai bản sửa mà không công bố chi tiết, còn Grok được liên hệ với sự cố tại trung tâm điện toán Memphis. Vì vậy, có thể xác nhận ba dịch vụ bị ảnh hưởng cùng lúc trong một khoảng nhất định, nhưng chưa thể kết luận chúng có chung một nguyên nhân.
Dòng thời gian chồng lấn theo UTC và giờ Việt Nam

Claude là dịch vụ đầu tiên trong ba hồ sơ bước vào giai đoạn điều tra, lúc 13:26 UTC, tức 20:26 ngày 3/9 tại Việt Nam. Grok bắt đầu được điều tra lúc 13:30 UTC, còn OpenAI ghi nhận sự cố ChatGPT và Codex từ 14:43 UTC, tương ứng 21:43 giờ Việt Nam.
- Claude: điều tra từ 13:26 UTC; bản sửa được triển khai lúc 16:06 UTC và tác động kết thúc lúc 16:16 UTC, tức 23:16 giờ Việt Nam.
- ChatGPT và Codex: điều tra từ 14:43 UTC; biện pháp giảm thiểu được áp dụng lúc 15:17 UTC và hồ sơ được đóng lúc 16:55 UTC, tức 23:55 giờ Việt Nam.
- Grok: điều tra từ 13:30 UTC; lưu lượng được xác nhận hoạt động bình thường trở lại lúc 17:05 UTC, tức 00:05 ngày 4/9 tại Việt Nam.
Khoảng giao nhau rõ nhất kéo dài từ 14:43 đến 16:16 UTC, khi cả ba hồ sơ đều chưa kết thúc. “Cùng gián đoạn” vì thế mô tả sự chồng lấn giữa các cửa sổ ảnh hưởng, không có nghĩa ba dịch vụ ngừng hoạt động trong cùng một phút hoặc phục hồi bằng cùng một biện pháp.
Mỗi nhà cung cấp công bố một mức thông tin khác nhau
Hồ sơ trạng thái của OpenAI liệt kê 15 thành phần ChatGPT và bốn thành phần Codex bị ảnh hưởng. OpenAI chuyển sự cố sang trạng thái giám sát sau khi áp dụng biện pháp giảm thiểu lúc 15:17 UTC, rồi xác nhận lỗi tăng cao đã được xử lý lúc 16:55 UTC; một số người dùng tính năng điều khiển Codex từ xa có thể phải ghép nối lại thiết bị di động.
OpenAI nói lỗi định tuyến bắt đầu khoảng 14:43 UTC và khiến ChatGPT cùng Codex không khả dụng với một bộ phận người dùng trên nhiều nền tảng. Tuy nhiên, thông tin công khai không xác định tuyến mạng cụ thể, hệ thống nội bộ hay nhà cung cấp bên ngoài nào gây ra lỗi.
Phạm vi 15 thành phần ChatGPT không đồng nghĩa mọi người dùng đều mất truy cập hoàn toàn. Trang trạng thái của OpenAI lưu ý rằng số liệu khả dụng được tổng hợp giữa các hạng thuê bao, mô hình và loại lỗi, nên tác động thực tế có thể khác nhau theo tính năng và cấu hình tài khoản.
Biên bản sự cố của Claude ghi nhận lỗi tăng cao từ 13:26 UTC trên các dòng Mythos/Fable 5.1, Mythos/Fable 5, Opus 5, Opus 4.8 và Opus 4.6. Anthropic cho biết đã xác định nguyên nhân lúc 13:41 UTC, nhưng không mô tả nguyên nhân đó; bản sửa được triển khai lúc 16:06 UTC và tác động kết thúc mười phút sau.
Khoảng từ lúc Claude bắt đầu điều tra đến khi hết tác động là 2 giờ 50 phút. Một sự cố riêng của Claude Sonnet 5 diễn ra từ 12:37 đến 12:56 UTC cùng ngày, nhưng hồ sơ này đã kết thúc trước khi ba cửa sổ chính chồng lấn và không nên được cộng vào thời lượng của sự cố nhiều mô hình.
Vì sao chưa thể quy cả ba sự cố cho Azure hoặc Cloudflare
OpenAI công bố lỗi định tuyến, còn thông báo được dẫn lại từ phía vận hành Grok cho biết dịch vụ bị ảnh hưởng sau một sự cố tại trung tâm điện toán Memphis. Anthropic chỉ xác nhận một vấn đề hạ tầng và không nêu nhà cung cấp bên ngoài trong thông tin công khai.
Ba mô tả này không thiết lập được một chuỗi nguyên nhân chung. Việc các bảng trạng thái đám mây lớn không hiển thị lỗi liên quan tại thời điểm kiểm tra cũng chỉ cho phép nói rằng chưa có xác nhận công khai về một điểm lỗi duy nhất; nó không chứng minh tuyệt đối rằng ba hệ thống không có bất kỳ phụ thuộc chung nào.
Các đợt tăng báo cáo trên Downdetector là tín hiệu về trải nghiệm của người dùng, không phải kết luận điều tra kỹ thuật. Báo cáo có thể phản ánh lỗi dịch vụ, kết nối cục bộ, đăng nhập hoặc việc người dùng đồng loạt thử nền tảng khác sau khi một công cụ ngừng đáp ứng. Vì khác phương pháp và phạm vi với trang trạng thái của nhà cung cấp, dữ liệu này không đủ để xác định nguyên nhân gốc.
Dự phòng đa mô hình vẫn cần hàng rào dữ liệu

Sự cố cho thấy một mô hình thay thế không tự động bảo đảm tính liên tục: nhiều nhà cung cấp có thể cùng bị gián đoạn trong một cửa sổ thời gian dù nguyên nhân chưa được chứng minh là giống nhau. Với hệ thống phụ thuộc API, chuyển tuyến cần đi cùng hàng đợi tác vụ và quy tắc dữ liệu, thay vì gửi nguyên trạng mọi yêu cầu sang dịch vụ thứ hai.
- Phân loại trước dữ liệu nào được phép chuyển nhà cung cấp; giữ lại yêu cầu chứa bí mật, dữ liệu cá nhân hoặc nội dung chịu yêu cầu lưu trú dữ liệu.
- Đưa tác vụ chưa hoàn tất vào hàng đợi có mã định danh chống xử lý trùng, giới hạn số lần thử lại và khoảng chờ tăng dần.
- Theo dõi riêng giao diện web, API, xác thực và từng mô hình, vì một thành phần phục hồi không đồng nghĩa toàn bộ dịch vụ đã bình thường.
- Chỉ mở tuyến thay thế sau khi kiểm tra chính sách lưu giữ, nơi xử lý và định dạng đầu ra; ghi lại nhà cung cấp đã nhận từng yêu cầu.
Trạng thái công khai hiện nay là cả ba sự cố đã được giải quyết. Điều đã được chứng minh là các khoảng gián đoạn chồng lấn và quá trình phục hồi diễn ra vào những thời điểm khác nhau; điều còn thiếu là hậu kiểm kỹ thuật đủ chi tiết để xác nhận hoặc loại trừ hoàn toàn một phụ thuộc chung.
Đọc thêm:
Đăng ký bản tin
Nhận tin Web3, AI và tiền mã hóa mới nhất ngay trong hộp thư.