ChatGPT và Claude gặp sự cố gián đoạn hoạt động: Tính toán thời gian chết thực tế
ChatGPT, Claude và Grok vừa đồng loạt gặp sự cố gián đoạn hoạt động trong cùng một ngày. Dữ liệu công khai cho thấy ChatGPT có thời gian hoạt động ổn định 99,64% (tương đương khoảng 8 giờ không hoạt động trong 90 ngày) và Claude là 99,4% (khoảng 13 giờ).

ChatGPT, Claude và Grok đều gặp sự cố ngừng hoạt động chỉ cách nhau vài tiếng vào ngày thứ Tư. Tần suất xảy ra tình trạng này là thông tin công khai: OpenAI báo cáo tỷ lệ hoạt động ổn định (uptime) của ChatGPT là 99,64% trong vòng 90 ngày, trong khi con số của Anthropic đối với claude.ai là 99,4%. Tính ra, con số này tương đương khoảng 8 và 13 giờ gián đoạn. Dưới đây là nơi lưu trữ các con số này và những việc cần làm trong lần sự cố tiếp theo.
Ba trong số các dịch vụ AI lớn nhất đã ngừng hoạt động trong vòng vài giờ đồng hồ của ngày thứ Tư, 3 tháng 9. OpenAI ghi nhận một sự cố mang tiêu đề "Lỗi tăng cao trên ChatGPT và Codex" lúc 14:58 UTC, ảnh hưởng đến 15 thành phần của ChatGPT và 4 thành phần của Codex. Công ty đánh dấu đã khắc phục xong lúc 16:55 UTC.
Anthropic ghi nhận hai sự cố riêng biệt trong cùng ngày. Sự cố đầu tiên tấn công Claude Sonnet 5 từ 12:37 đến 12:56 UTC. Sự cố thứ hai diễn ra từ 13:26 đến 16:16 UTC và bao gồm, theo danh sách của chính Anthropic, Mythos và Fable 5.1, Mythos và Fable 5, Opus 5, Opus 4.8 và Opus 4.6. xAI cũng ghi nhận sự cố đối với Grok. Gemini của Google là dịch vụ duy nhất trong số bốn dịch vụ lớn không có thông báo ngừng hoạt động chính thức, mặc dù Downdetector vẫn thu thập khoảng 500 báo cáo về nó. ChatGPT đạt đỉnh với hơn 35.000 báo cáo tại Mỹ, Claude khoảng 1.400 và Grok khoảng 1.200.
Tất cả những điều đó chỉ là một khoảnh khắc và đã qua đi. Phần thú vị hơn bắt đầu khi bạn rời khỏi một ngày đơn lẻ và xem xét những gì các nhà cung cấp công bố về độ tin cậy của chính họ. Những con số đó là công khai, và hầu như không ai đọc chúng.
Các con số nằm trên trang trạng thái của chính nhà cung cấp
OpenAI báo cáo tính khả dụng 99,64% cho ChatGPT trên status.openai.com, được đo lường trong khoảng thời gian 90 ngày cuộn. Các API hoạt động tốt hơn đáng kể ở mức 99,94% và Codex đạt 100%. Anthropic công bố 99,4% cho claude.ai trên status.claude.com trong cùng kỳ, 99,5% cho API, 99,44% cho Claude Code và 99,43% cho Claude Cowork. Cả hai công ty đều lưu ý rằng đây là các số liệu tổng hợp trên tất cả các cấp và mô hình, vì vậy trải nghiệm của từng cá nhân có thể khác nhau.
Các tỷ lệ phần trăm có hai chữ số thập phân không cho bạn biết nhiều điều, vì vậy đây là các giá trị tương đương theo thời gian. Trong 90 ngày, 99,64% có nghĩa là khoảng 467 phút không có dịch vụ, tức là dưới tám giờ một chút. Mức 99,4% của claude.ai tính ra khoảng 778 minutes, tức là hơn 13 giờ một chút. Đó là một ngày làm việc đầy đủ cộng với thời gian làm thêm, được phân bổ trong một quý.
Lịch sử sự cố cũng cho thấy điều tương tự. Danh sách công khai của OpenAI chứa 36 sự cố được ghi nhận riêng lẻ trong tháng 7, 19 sự cố trong tháng 8 và thêm 5 sự cố trong ba ngày đầu tiên của tháng 9. Ngày thứ Tư không phải là một ngoại lệ, đó là ngày mà một số nhà cung cấp đồng loạt gặp lỗi và mọi người chú ý.
Không ai có liên quan đưa ra nguyên nhân cụ thể
Nhiều bài báo chỉ ra lỗi tại khu vực Azure Đông Mỹ, nơi ChatGPT, Claude và Grok đều sử dụng tài nguyên tính toán, nhưng mối liên kết đó không được ghi chép lại. Lịch sử trạng thái Azure chính thức của Microsoft, nơi thu thập các Đánh giá Sau Sự cố, không chứa mục nhập nào cho khu vực Đông Mỹ vào ngày hôm đó. Báo cáo gần nhất được công bố ở đó có từ ngày 23 tháng 7 và liên quan đến khu vực Tây Mỹ.
Cả OpenAI lẫn Anthropic đều không đưa ra lý do trong ghi chú sự cố của họ. Điều đó đặc biệt nổi bật ở Anthropic, vì công ty đã tỏ ra rõ ràng chỉ vài ngày trước đó. Vào ngày 28 tháng 8, họ tuyên bố đã xác định được "một vấn đề với nhà cung cấp đám mây thượng nguồn" ảnh hưởng đến Claude Cowork và Claude Code trên web. Đối với ngày thứ Tư, không có sự quy kết nào như vậy xuất hiện. Bất kỳ ai đưa ra lời giải thích về Azure như một điều chắc chắn đều đang vượt qua những gì có trong hồ sơ.
OpenAI đã đưa ra một lưu ý thực tế. Nếu bạn sử dụng Codex thông qua điều khiển từ xa trên thiết bị di động, bạn có thể cần ghép nối lại thiết bị của mình sau sự cố này.
Cách kiểm tra xem vấn đề có phải do bạn hay không
Khi một chatbot đột ngột đưa ra lỗi, bản năng đầu tiên là tìm lỗi ở phía bạn, chuyển trình duyệt, đăng xuất rồi đăng nhập lại. Ba địa chỉ sẽ giúp bạn tiết kiệm việc đó. OpenAI giữ trạng thái hiện tại và lịch sử sự cố đầy đủ tại status.openai.com, Anthropic tại status.claude.com, xAI tại status.x.ai. Gemini xuất hiện trong Bảng điều khiển Trạng thái Google Workspace.
Các trang này đi kèm với một điểm bắt lấy. Các nhà cung cấp tự duy trì chúng và chúng thường xuyên chậm hơn những gì người dùng đang thấy. Vào ngày thứ Tư, các báo cáo trên Downdetector đã tăng vọt trước khi các mục chính thức xuất hiện. Kiểm tra cả hai là một cách đáng tin cậy để tách biệt vấn đề của bạn với vấn đề của họ.
Có thêm gói đăng ký thứ hai chỉ giúp ích được phần nào
Biện pháp hiển nhiên là đăng ký với hai nhà cung cấp. Ngày thứ Tư cho thấy tại sao đó không phải là một kế hoạch an toàn. ChatGPT, Claude và Grok đều bị giảm chất lượng trong cùng một khung thời gian trong khi Gemini vẫn tiếp tục chạy. Dịch vụ nào nằm trên cơ sở hạ tầng nào, và nơi nào hai nhà cung cấp chia sẻ sự phụ thuộc, là điều gần như không thể xác định từ bên ngoài. Hai gói đăng ký chỉ bảo vệ bạn nếu chúng tình cờ đứng trên các chân đế khác nhau.
Một mô hình chạy trên phần cứng của chính bạn mà không cần kết nối internet sẽ đáng tin cậy hơn. Các mô hình đó giờ đây đã đủ nhỏ cho các thiết bị thông thường. Chúng tôi đã chỉ ra cách một mô hình ngôn ngữ có thể vừa vặn trên iPhone, và Meta tiếp tục với Muse Glimmer, một tùy chọn miễn phí từ 24 GB bộ nhớ đồ họa. Chúng không sánh bằng chất lượng của các mô hình đám mây lớn. Nhưng trong trường hợp nhà cung cấp của bạn đơn giản là không thể tiếp cận được, chúng vẫn có giá trị hơn là một hóa đơn hàng tháng thứ hai.
Tình trạng ngừng hoạt động tại Anthropic cũng không có gì mới, như chúng tôi đã đưa tin vào cuối tháng 8, khi một số mô hình Claude đồng thời đưa ra lỗi.
💻 CHATGPT VÀ CLAUDE GẶP SỰ CỐ GIÁN ĐOẠN HOẠT ĐỘNG: TÍNH TOÁN THỜI GIAN CHẾT THỰC TẾ ChatGPT, Claude và Grok đều gặp sự cố ngừng hoạt động chỉ cách nhau vài tiếng vào ngày thứ Tư. Tần suất xảy ra tình trạng này là thông tin công khai: OpenAI báo cáo tỷ lệ hoạt động ổn định (uptime) của ChatGPT là 99,64% trong vòng 90 ngày, trong khi con số của Anthropic đối với claude.ai là 99,4%. Tính ra, con số này tương đương khoảng 8 và 13 giờ gián đoạn. Dưới đây là nơi lưu trữ các con số này và những việc cần làm trong lần sự cố tiếp theo. Ba trong số các dịch vụ AI lớn nhất đã ngừng hoạt động trong vòng vài giờ đồng hồ của ngày thứ Tư, 3 tháng 9. OpenAI ghi nhận một sự cố mang tiêu đề "Lỗi tăng cao trên ChatGPT và Codex" lúc 14:58 UTC, ảnh hưởng đến 15 thành phần của ChatGPT và 4 thành phần của Codex. Công ty đánh dấu đã khắc phục xong lúc 16:55 UTC. Anthropic ghi nhận hai sự cố riêng biệt trong cùng ngày. Sự cố đầu tiên tấn công Claude Sonnet 5 từ 12:37 đến 12:56 UTC. Sự cố thứ hai diễn ra từ 13:26 đến 16:16 UTC và bao gồm, theo danh sách của chính Anthropic, Mythos và Fable 5.1, Mythos và Fable 5, Opus 5, Opus 4.8 và Opus 4.6. xAI cũng ghi nhận sự cố đối với Grok. Gemini của Google là dịch vụ duy nhất trong số bốn dịch vụ lớn không có thông báo ngừng hoạt động chính thức, mặc dù Downdetector vẫn thu thập khoảng 500 báo cáo về nó. ChatGPT đạt đỉnh với hơn 35.000 báo cáo tại Mỹ, Claude khoảng 1.400 và Grok khoảng 1.200. Tất cả những điều đó chỉ là một khoảnh khắc và đã qua đi. Phần thú vị hơn bắt đầu khi bạn rời khỏi một ngày đơn lẻ và xem xét những gì các nhà cung cấp công bố về độ tin cậy của chính họ. Những con số đó là công khai, và hầu như không ai đọc chúng. Các con số nằm trên trang trạng thái của chính nhà cung cấp OpenAI báo cáo tính khả dụng 99,64% cho ChatGPT trên status.openai.com, được đo lường trong khoảng thời gian 90 ngày cuộn. Các API hoạt động tốt hơn đáng kể ở mức 99,94% và Codex đạt 100%. Anthropic công bố 99,4% cho claude.ai trên status.claude.com trong cùng kỳ, 99,5% cho API, 99,44% cho Claude Code và 99,43% cho Claude Cowork. Cả hai công ty đều lưu ý rằng đây là các số liệu tổng hợp trên tất cả các cấp và mô hình, vì vậy trải nghiệm của từng cá nhân có thể khác nhau. Các tỷ lệ phần trăm có hai chữ số thập phân không cho bạn biết nhiều điều, vì vậy đây là các giá trị tương đương theo thời gian. Trong 90 ngày, 99,64% có nghĩa là khoảng 467 phút không có dịch vụ, tức là dưới tám giờ một chút. Mức 99,4% của claude.ai tính ra khoảng 778 minutes, tức là hơn 13 giờ một chút. Đó là một ngày làm việc đầy đủ cộng với thời gian làm thêm, được phân bổ trong một quý. Lịch sử sự cố cũng cho thấy điều tương tự. Danh sách công khai của OpenAI chứa 36 sự cố được ghi nhận riêng lẻ trong tháng 7, 19 sự cố trong tháng 8 và thêm 5 sự cố trong ba ngày đầu tiên của tháng 9. Ngày thứ Tư không phải là một ngoại lệ, đó là ngày mà một số nhà cung cấp đồng loạt gặp lỗi và mọi người chú ý. Không ai có liên quan đưa ra nguyên nhân cụ thể Nhiều bài báo chỉ ra lỗi tại khu vực Azure Đông Mỹ, nơi ChatGPT, Claude và Grok đều sử dụng tài nguyên tính toán, nhưng mối liên kết đó không được ghi chép lại. Lịch sử trạng thái Azure chính thức của Microsoft, nơi thu thập các Đánh giá Sau Sự cố, không chứa mục nhập nào cho khu vực Đông Mỹ vào ngày hôm đó. Báo cáo gần nhất được công bố ở đó có từ ngày 23 tháng 7 và liên quan đến khu vực Tây Mỹ. Cả OpenAI lẫn Anthropic đều không đưa ra lý do trong ghi chú sự cố của họ. Điều đó đặc biệt nổi bật ở Anthropic, vì công ty đã tỏ ra rõ ràng chỉ vài ngày trước đó. Vào ngày 28 tháng 8, họ tuyên bố đã xác định được "một vấn đề với nhà cung cấp đám mây thượng nguồn" ảnh hưởng đến Claude Cowork và Claude Code trên web. Đối với ngày thứ Tư, không có sự quy kết nào như vậy xuất hiện. Bất kỳ ai đưa ra lời giải thích về Azure như một điều chắc chắn đều đang vượt qua những gì có trong hồ sơ. OpenAI đã đưa ra một lưu ý thực tế. Nếu bạn sử dụng Codex thông qua điều khiển từ xa trên thiết bị di động, bạn có thể cần ghép nối lại thiết bị của mình sau sự cố này. Cách kiểm tra xem vấn đề có phải do bạn hay không Khi một chatbot đột ngột đưa ra lỗi, bản năng đầu tiên là tìm lỗi ở phía bạn, chuyển trình duyệt, đăng xuất rồi đăng nhập lại. Ba địa chỉ sẽ giúp bạn tiết kiệm việc đó. OpenAI giữ trạng thái hiện tại và lịch sử sự cố đầy đủ tại status.openai.com, Anthropic tại status.claude.com, xAI tại status.x.ai. Gemini xuất hiện trong Bảng điều khiển Trạng thái Google Workspace. Các trang này đi kèm với một điểm bắt lấy. Các nhà cung cấp tự duy trì chúng và chúng thường xuyên chậm hơn những gì người dùng đang thấy. Vào ngày thứ Tư, các báo cáo trên Downdetector đã tăng vọt trước khi các mục chính thức xuất hiện. Kiểm tra cả hai là một cách đáng tin cậy để tách biệt vấn đề của bạn với vấn đề của họ. Có thêm gói đăng ký thứ hai chỉ giúp ích được phần nào Biện pháp hiển nhiên là đăng ký với hai nhà cung cấp. Ngày thứ Tư cho thấy tại sao đó không phải là một kế hoạch an toàn. ChatGPT, Claude và Grok đều bị giảm chất lượng trong cùng một khung thời gian trong khi Gemini vẫn tiếp tục chạy. Dịch vụ nào nằm trên cơ sở hạ tầng nào, và nơi nào hai nhà cung cấp chia sẻ sự phụ thuộc, là điều gần như không thể xác định từ bên ngoài. Hai gói đăng ký chỉ bảo vệ bạn nếu chúng tình cờ đứng trên các chân đế khác nhau. Một mô hình chạy trên phần cứng của chính bạn mà không cần kết nối internet sẽ đáng tin cậy hơn. Các mô hình đó giờ đây đã đủ nhỏ cho các thiết bị thông thường. Chúng tôi đã chỉ ra cách một mô hình ngôn ngữ có thể vừa vặn trên iPhone, và Meta tiếp tục với Muse Glimmer, một tùy chọn miễn phí từ 24 GB bộ nhớ đồ họa. Chúng không sánh bằng chất lượng của các mô hình đám mây lớn. Nhưng trong trường hợp nhà cung cấp của bạn đơn giản là không thể tiếp cận được, chúng vẫn có giá trị hơn là một hóa đơn hàng tháng thứ hai. Tình trạng ngừng hoạt động tại Anthropic cũng không có gì mới, như chúng tôi đã đưa tin vào cuối tháng 8, khi một số mô hình Claude đồng thời đưa ra lỗi. 🗞 Nguồn: Notebookcheck #vgsnews #vgs #tintuc
Nguồn: Notebookcheck