Chi tiết câu chuyện về mô hình của OpenAI mất kiểm soát: phức tạp hơn bạn nghĩ, đã báo cáo FBI

Christine May
Christine May
Phản hồi: 0

Christine May

Editor
Thành viên BQT
Christine May

Christine May Đã xác thực

Theo Reuters, một cuộc điều tra dựa trên nhiều nguồn tin thân cận cho thấy vụ tác nhân AI (AI agent) của OpenAI xâm nhập nền tảng Hugging Face có diễn biến phức tạp hơn những gì công ty từng công bố. Đáng chú ý, OpenAI được cho là chỉ phát hiện chính hệ thống của mình là nguyên nhân sau khi cuộc tấn công đã kết thúc nhiều ngày.

Các nguồn tin cho biết vào khoảng 09/07, một AI agent của OpenAI đã tìm cách thoát khỏi môi trường thử nghiệm biệt lập. Đây là loại hệ thống có khả năng tự đưa ra quyết định và thực hiện các nhiệm vụ phức tạp với rất ít hoặc không cần con người giám sát. Đến 11/07, theo ông Thomas Wolf, đồng sáng lập Hugging Face, nền tảng này bắt đầu hứng chịu một cuộc tấn công mạng kéo dài đến 13/07.

Hugging Face là nền tảng lưu trữ mã nguồn và mô hình AI lớn nhất thế giới dành cho cộng đồng phát triển trí tuệ nhân tạo. Ông Wolf cùng ba nguồn tin tham gia điều tra cho biết phải đến vài ngày sau OpenAI mới nhận ra tác nhân AI của chính mình là thủ phạm. Hai công ty chỉ bắt đầu trao đổi trực tiếp về vụ việc vào khoảng 20/07.
1784954828262.png

Ngày 21/07, OpenAI công khai xác nhận một AI agent của hãng đã mất kiểm soát trong quá trình thử nghiệm và xâm nhập vào Hugging Face. Tuy nhiên, Reuters cho biết đây là lần đầu tiên các chi tiết như thời điểm AI hoạt động bất thường và việc OpenAI phát hiện khá muộn được tiết lộ.

Ông Thomas Wolf cho biết Hugging Face đang chuẩn bị công bố toàn bộ dòng thời gian của vụ tấn công, nhưng từ chối bình luận về những gì xảy ra bên trong OpenAI.

Trong phản hồi gửi Reuters, OpenAI gọi đây là sự cố "chưa từng có tiền lệ" và là "một cột mốc quan trọng đối với lĩnh vực an ninh AI". Công ty cho biết đang phối hợp với các chuyên gia độc lập để điều tra và sẽ công bố báo cáo kỹ thuật trong thời gian tới. Tuy nhiên, người phát ngôn của OpenAI cũng nói bài viết của Reuters có "một số điểm không chính xác", nhưng không nêu cụ thể đó là những điểm nào.

Theo Reuters, sự cố bắt đầu trong quá trình OpenAI thử nghiệm khả năng an ninh mạng của một AI agent được vận hành bằng hai mô hình tiên tiến nhất của hãng, gồm GPT 5.6 Sol và một mô hình mạnh hơn nhưng chưa được phát hành. Ba nguồn tin cho biết đã xuất hiện nhiều dấu hiệu bất thường từ trước khi vụ tấn công xảy ra.

Trong một trường hợp, AI agent được cho là đã để lại các "ghi chú" dành cho những phiên bản AI trong tương lai, hướng dẫn cách vượt qua các cơ chế kiểm soát nội bộ của OpenAI. Một nguồn tin khác tiết lộ rằng trong các thử nghiệm trước đây từng xảy ra tình trạng hệ thống giám sát bị ngắt kết nối. Reuters chưa thể xác nhận liệu những dấu hiệu này có liên quan trực tiếp đến vụ AI thoát khỏi môi trường thử nghiệm và tấn công Hugging Face hay không.

Hai nguồn tin cho biết OpenAI chỉ bắt đầu nghi ngờ hệ thống của mình sau khi Hugging Face đăng bài viết ngày 16/07, trong đó cho biết công ty đã bị "một hệ thống AI agent tự động" tấn công. Điều đó đồng nghĩa với việc đã có khoảng một tuần trôi qua kể từ khi AI xuất hiện hành vi bất thường cho đến khi OpenAI xác định được nguyên nhân.

Đến cuối tuần 18/07 đến 19/07, các kỹ sư OpenAI mới tìm thấy bằng chứng trong nhật ký hệ thống cho thấy AI agent đã vượt qua các giới hạn được thiết lập trong môi trường thử nghiệm. Reuters cho biết chưa thể xác định điều gì khiến OpenAI kiểm tra kỹ các bản ghi này vào thời điểm đó.

Bốn nguồn tin am hiểu quy trình huấn luyện mô hình của OpenAI cho biết công ty thường chạy đồng thời rất nhiều bài kiểm tra AI với tốc độ cực nhanh, tạo ra khối lượng dữ liệu khổng lồ khiến nhân viên khó theo dõi toàn bộ hoạt động của hệ thống.

Reuters cũng dẫn các nguồn tin cho biết trước khi cảnh báo Hugging Face, OpenAI đã báo cáo vụ việc với Cục Điều tra Liên bang Mỹ (FBI). Tuy nhiên, hãng tin chưa thể xác nhận liệu FBI đã mở cuộc điều tra chính thức hay chưa.
 


Đăng nhập một lần thảo luận tẹt ga
Thành viên mới đăng
http://textlink.linktop.vn/?adslk=aHR0cHM6Ly93d3cudm5yZXZpZXcudm4vdGhyZWFkcy9jaGktdGlldC1jYXUtY2h1eWVuLXZlLW1vLWhpbmgtY3VhLW9wZW5haS1tYXQta2llbS1zb2F0LXBodWMtdGFwLWhvbi1iYW4tbmdoaS1kYS1iYW8tY2FvLWZiaS44ODUzMi8=
Top