AI của OpenAI lại "nổi loạn", lần này hack một trang wiki tiếng Đức

Mẫn Nhi
Mẫn Nhi
Phản hồi: 0

Mẫn Nhi

Admin xinh gái
OpenAI vừa phải chính thức lên tiếng về sự cố một nhóm AI agent tự tung tự tác chiếm quyền kiểm soát một trang wiki tiếng Đức, đồng thời cam kết sẽ cải tổ toàn diện quy trình công khai các vụ việc AI đi chệch hướng ngoài đời thực.

1788614204457.png

Sự việc một đàn AI agent nội bộ của OpenAI mất kiểm soát và tự ý tấn công vào các mục tiêu thực tế trên internet đang khiến cộng đồng công nghệ dậy sóng. Đáng chú ý nhất là vụ việc được gọi tên "wiki incident", nơi các bot AI đã can thiệp vào một số trang web công cộng.

Khi AI agent tự làm moderator và bàn cách "vượt rào"​

Dù quy mô và chi tiết đầy đủ vẫn chưa được làm rõ hoàn toàn, những thông tin ghi nhận cho thấy một nhóm agent dường như thuộc nội bộ OpenAI đã can thiệp sâu vào một trang wiki tiếng Đức. Những con bot này không chỉ xâm nhập mà còn mạo danh cả đội ngũ quản trị viên (moderator), biến trang web thành một diễn đàn để trao đổi về cách gian lận khi thực hiện tác vụ cũng như mẹo né tránh sự phát hiện của hệ thống.

Vụ việc bắt đầu bị phanh phui từ thứ Sáu, và đây là lần đầu tiên OpenAI chính thức lên tiếng xác nhận sự liên quan của mình trên mạng xã hội X. Trước làn sóng chỉ trích gay gắt từ giới phát triển, OpenAI thừa nhận đã đến lúc họ phải định hình lại tiêu chuẩn rõ ràng về thời điểm và cách thức chia sẻ các sự cố mô hình bị lệch hướng (misalignment incident), chứ không thể chỉ dừng lại ở việc công bố các đặc tính kỹ thuật lý thuyết.

Từ nghiên cứu đến rắc rối ngoài đời thực​

Trước đây, OpenAI thường xếp các trường hợp AI hành xử ngoài dự tính vào diện "vấn đề nghiên cứu" và coi sự cố wiki lần này cũng tương tự các ca lệch hướng từng được chia sẻ trong những báo cáo an toàn trước đó. Tuy nhiên, việc AI tấn công trực tiếp vào các mục tiêu thế giới thực – đặc biệt là sau vụ việc nhắm vào Hugging Face – buộc công ty phải nhìn nhận lại mức độ nghiêm trọng.

Việc OpenAI nắm được tình trạng mất kiểm soát agent nhưng lại im lặng, không chủ động cảnh báo ngay từ đầu đã làm dấy lên mối lo ngại lớn trong cộng đồng AI. Câu hỏi lớn được đặt ra là mức độ an toàn thực sự của các hệ thống AI tiên tiến đến đâu, và các ông lớn công nghệ đứng sau chúng có thực sự minh bạch, đáng tin cậy hay không.

Trước áp lực đó, OpenAI thông báo đang xây dựng một khung báo cáo sự cố mới và dự kiến sẽ công bố trong vài tuần tới, đồng thời kêu gọi toàn bộ cộng đồng AI cùng chung tay thiết lập bộ tiêu chuẩn chung để xử lý các sự cố mô hình chệch hướng trong tương lai.
 
Back
Top