Vì sao ChatGPT, Claude và Grok cùng sập một lúc?

K
Kaya
Phản hồi: 0
  • Thread starter Thread starter Kaya
  • Ngày gửi Ngày gửi

Kaya

Writer
ChatGPT, Claude và Grok đồng loạt gặp sự cố trong đêm 3/9 (theo giờ Việt Nam), khiến nhiều người dùng không thể truy cập hoặc nhận phản hồi. Việc các chatbot cùng gặp lỗi mà còn cho thấy AI hiện đại phụ thuộc vào một hệ thống hạ tầng phức tạp đến mức nào.​

Không phải AI “tự nhiên biến mất”mà là một mắt xích trong hệ thống gặp vấn đề​

Khi người dùng mở ChatGPT và gửi một câu hỏi, phía sau thao tác tưởng như đơn giản đó là cả một chuỗi hệ thống: kết nối Internet, DNS, định tuyến lưu lượng, máy chủ ứng dụng, hệ thống xác thực, API, cụm máy tính xử lý mô hình AI và kho dữ liệu.

Chỉ cần một mắt xích gặp vấn đề, người dùng có thể nhìn thấy kết quả rất đơn giản: AI không trả lời. Trong sự cố ngày 3/9, ChatGPT, Claude và Grok đều gặp gián đoạn trong khoảng thời gian gần nhau. Tuy nhiên, các thông tin được công bố cho thấy chưa có cơ sở để kết luận cả ba cùng bị một sự cố duy nhất.​

ChatGPT gặp lỗi định tuyến​

Với ChatGPT, OpenAI cho biết một lỗi định tuyến (routing error) bắt đầu vào khoảng 7h43 sáng theo giờ Thái Bình Dương ngày 3/9 khiến ChatGPT và Codex không thể hoạt động bình thường đối với một số người dùng trên nhiều nền tảng.

Khoảng 34 phút sau, OpenAI cho biết đã triển khai giải pháp và tiếp tục theo dõi hệ thống. Hiểu đơn giản, định tuyến giống như hệ thống điều phối giao thông trên Internet. Khi yêu cầu của người dùng không được chuyển đúng đến nơi cần xử lý, máy chủ AI dù vẫn đang hoạt động cũng có thể trở nên “vô dụng” với người dùng. Đây cũng là lý do một dịch vụ trực tuyến có thể gặp lỗi dù mô hình AI bên trong không hề bị hỏng.
da394804-75dc-4473-9b6c-33d709f92a14.png

Claude lại gặp vấn đề ở một tầng khác

Anthropic thông báo Claude gặp tình trạng lỗi gia tăng đối với các yêu cầu gửi đến một số mô hình. Sự cố không chỉ ảnh hưởng chatbot Claude mà còn liên quan đến Claude Code và Claude API.

Anthropic sau đó cho biết đã xác định nguyên nhân và triển khai biện pháp khắc phục. Sự cố được đánh dấu giải quyết trong ngày.

Điều này cho thấy một điểm đáng chú ý: AI không chỉ là một chatbot trên website. Rất nhiều doanh nghiệp hiện sử dụng API của các hãng AI để đưa khả năng xử lý ngôn ngữ, lập trình hoặc phân tích vào ứng dụng của riêng mình. Khi API gặp sự cố, ảnh hưởng có thể lan sang nhiều sản phẩm khác dù những sản phẩm đó không mang tên Claude.​

Grok cũng gặp sự cố, nhưng nguyên nhân được cho là khác​

Với Grok, xAI cho biết sự cố liên quan đến trung tâm tính toán tại Memphis. Đây là nơi cung cấp năng lực tính toán cho các hệ thống AI của công ty. Nói cách khác, nếu ChatGPT gặp vấn đề ở khâu điều phối lưu lượng, còn Grok gặp sự cố tại hạ tầng tính toán, người dùng cuối vẫn có thể nhìn thấy cùng một hiện tượng: không sử dụng được chatbot.

Đây chính là điểm dễ gây hiểu nhầm khi nhìn vào sự cố từ phía người dùng.​

Vì sao ba AI khác nhau lại có thể “sập” gần như cùng lúc?​

Có ít nhất ba khả năng cần phân biệt.

Thứ nhất, các sự cố có thể hoàn toàn độc lập.

Các hệ thống Internet quy mô lớn luôn có hàng nghìn thành phần hoạt động đồng thời. Việc nhiều dịch vụ lớn gặp lỗi trong cùng một khoảng thời gian không đồng nghĩa chúng chắc chắn có chung nguyên nhân.

Thứ hai, các nền tảng AI đều phụ thuộc vào những lớp hạ tầng tương tự nhau.

Dù mỗi công ty có kiến trúc riêng, các dịch vụ AI đều cần trung tâm dữ liệu, mạng truyền dẫn, hệ thống định tuyến, máy chủ, GPU, dịch vụ lưu trữ và nhiều thành phần của bên thứ ba.

Nếu một thành phần dùng chung gặp vấn đề, nhiều dịch vụ có thể bị ảnh hưởng. Tuy nhiên, hiện chưa có thông tin chính thức xác nhận đây là trường hợp của ChatGPT, Claude và Grok trong sự cố lần này.

Thứ ba, lưu lượng truy cập và những thay đổi lớn trong hệ thống có thể tạo thêm áp lực.

Sự cố lần này còn xảy ra trong thời điểm OpenAI được cho là đang chuẩn bị công bố một mô hình mới, khiến lượng người dùng quan tâm đến dịch vụ tăng cao. Tuy nhiên, đây mới chỉ là sự trùng hợp về thời điểm, chưa có bằng chứng cho thấy hoạt động này là nguyên nhân khiến ChatGPT gặp lỗi.​

AI càng mạnh, hệ thống phía sau càng phức tạp​

Sự cố lần này cho thấy một nghịch lý: người dùng ngày càng coi AI như một công cụ luôn sẵn sàng, nhưng để duy trì một chatbot hoạt động 24/7 lại cần một hệ thống hạ tầng khổng lồ.

Một câu hỏi gửi đến ChatGPT có thể chỉ mất vài giây để người dùng nhận được câu trả lời, nhưng phía sau là quá trình tiếp nhận yêu cầu, xác thực, định tuyến, phân bổ tài nguyên tính toán, chạy mô hình và trả kết quả.

Vì vậy, “AI bị sập” không nhất thiết có nghĩa mô hình AI đã hỏng. Có thể chỉ cần mạng không định tuyến được yêu cầu, máy chủ quá tải hoặc một trung tâm tính toán gặp sự cố, toàn bộ trải nghiệm của người dùng cũng có thể dừng lại.

Sự cố của ChatGPT, Claude và Grok vì thế không chỉ là câu chuyện về ba chatbot gặp lỗi. Nó là lời nhắc rằng AI đang trở thành một phần của hạ tầng số, và khi con người ngày càng phụ thuộc vào AI cho công việc, lập trình, học tập hay vận hành doanh nghiệp, độ ổn định của những hệ thống phía sau cũng trở nên quan trọng không kém bản thân mô hình AI.​
 
Được phối hợp thực hiện bởi các chuyên gia của Bkav, cộng đồng An ninh mạng Việt Nam WhiteHat và cộng đồng Khoa học công nghệ VnReview
Back
Top