Mẫn Nhi✔
Admin xinh gái
Cuộc điều tra vụ một AI agent xâm nhập mạng của Hugging Face đang mở rộng theo hướng đáng lo hơn: OpenAI phát hiện thêm một số trường hợp agent tự động thoát khỏi môi trường thử nghiệm cô lập. Các sự cố được cho là có phạm vi hạn chế và chưa có agent nào rời khỏi mạng nội bộ của OpenAI.

OpenAI đang xem xét thêm nhiều trường hợp AI agent tự động vượt khỏi môi trường kiểm soát, trong quá trình điều tra vụ xâm nhập hệ thống của Hugging Face gây chú ý hồi đầu tháng 7.
Hai người am hiểu vấn đề cho biết những trường hợp mới được phát hiện khi OpenAI rà soát cách một agent thoát khỏi môi trường thử nghiệm vốn được thiết kế để cô lập hoạt động của nó. Công ty hiện đã đưa các sự việc này vào phạm vi điều tra.
Một nguồn tin mô tả các lần vượt kiểm soát có quy mô hạn chế. Hiện chưa có dấu hiệu cho thấy bất kỳ agent nào đã rời khỏi mạng của OpenAI.
Trong tuyên bố đưa ra hôm thứ Ba, OpenAI nói đang xem xét “hoạt động rộng hơn từ các mô hình của chúng tôi”, chứ không chỉ riêng vụ xâm nhập Hugging Face.
Cuộc điều tra ban đầu được mở sau sự cố tại Hugging Face hồi đầu tháng 7. Khi đó, một AI agent của OpenAI đã hoạt động ngoài dự kiến suốt nhiều ngày trong mạng của công ty khác, trong một nỗ lực gian lận bài kiểm tra nội bộ nhưng thất bại.
OpenAI cho biết bốn tài khoản tại bốn công ty khác cũng bị xâm phạm trong chuỗi hoạt động này. Một trong số đó thuộc về Modal, doanh nghiệp có trụ sở tại New York.
Phạm vi điều tra được mở rộng không lâu trước khi Anthropic, đối thủ chính của OpenAI, công bố rằng các mô hình của hãng cũng đứng sau một loạt vụ đột nhập. Những hoạt động này dẫn đến vi phạm hệ thống tại ba công ty khác, với các sự cố có từ tháng 4.
Maurice Chiodo, nhà toán học làm việc tại Trung tâm Nghiên cứu Rủi ro Hiện sinh của Đại học Cambridge, nhận xét: “Chúng ta có cả một ngành mà những người thiết kế, phát triển và đưa các công cụ này ra sử dụng lại không theo kịp yêu cầu phát triển có trách nhiệm và giữ chúng an toàn.”
Chiodo đặc biệt lo ngại trước dấu hiệu OpenAI và Anthropic không theo dõi đầy đủ các agent khi chúng bắt đầu hoạt động ngoài kiểm soát.
OpenAI được cho là chỉ nhận ra agent đã xâm nhập Hugging Face sau khi phía Hugging Face khống chế sự cố, liên hệ FBI và công khai vụ việc. OpenAI từng nói mô tả này có một số điểm không chính xác, nhưng chưa nêu rõ đó là những điểm nào.
Về phía Anthropic, công ty thừa nhận việc giám sát nhật ký đánh giá theo thời gian thực có thể giúp phát hiện vấn đề sớm hơn. Anthropic cho biết hệ thống giám sát thời gian thực vẫn tồn tại, nhưng không được áp dụng cho nhóm nguy cơ này do hiểu nhầm giữa hãng và một đối tác.
“Có vẻ như họ thậm chí còn không theo dõi,” Chiodo bình luận.
Tổng thống Mỹ Donald Trump cho biết chính quyền đang xem xét các biện pháp kiểm soát. Ủy ban châu Âu cũng đã trao đổi với OpenAI và Anthropic về các vụ xâm nhập.
Thượng nghị sĩ Mark Warner, thành viên cấp cao của đảng Dân chủ tại Ủy ban Tình báo Thượng viện Mỹ, cho rằng sự cố liên quan đến Anthropic cho thấy việc yêu cầu kiểm tra bắt buộc năng lực của các mô hình AI tiên tiến là hướng đi đúng về mặt lập pháp.
Những lần “vượt rào” có thể vẫn đang được mô tả là hạn chế, nhưng vấn đề cốt lõi khó bỏ qua: AI agent đã đủ khả năng gây ra sự cố thật, trong khi lớp giám sát dành cho chúng vẫn để lộ khoảng trống.

OpenAI đang xem xét thêm nhiều trường hợp AI agent tự động vượt khỏi môi trường kiểm soát, trong quá trình điều tra vụ xâm nhập hệ thống của Hugging Face gây chú ý hồi đầu tháng 7.
Hai người am hiểu vấn đề cho biết những trường hợp mới được phát hiện khi OpenAI rà soát cách một agent thoát khỏi môi trường thử nghiệm vốn được thiết kế để cô lập hoạt động của nó. Công ty hiện đã đưa các sự việc này vào phạm vi điều tra.
Một nguồn tin mô tả các lần vượt kiểm soát có quy mô hạn chế. Hiện chưa có dấu hiệu cho thấy bất kỳ agent nào đã rời khỏi mạng của OpenAI.
Trong tuyên bố đưa ra hôm thứ Ba, OpenAI nói đang xem xét “hoạt động rộng hơn từ các mô hình của chúng tôi”, chứ không chỉ riêng vụ xâm nhập Hugging Face.
Chưa rõ có bao nhiêu sự cố
Số lượng chính xác, thời điểm và hoàn cảnh xảy ra các sự cố chưa được xác định. OpenAI cùng các chuyên gia bên ngoài đang kiểm tra dữ liệu nhật ký từ đầu năm để làm rõ chuyện gì đã diễn ra.Cuộc điều tra ban đầu được mở sau sự cố tại Hugging Face hồi đầu tháng 7. Khi đó, một AI agent của OpenAI đã hoạt động ngoài dự kiến suốt nhiều ngày trong mạng của công ty khác, trong một nỗ lực gian lận bài kiểm tra nội bộ nhưng thất bại.
OpenAI cho biết bốn tài khoản tại bốn công ty khác cũng bị xâm phạm trong chuỗi hoạt động này. Một trong số đó thuộc về Modal, doanh nghiệp có trụ sở tại New York.
Phạm vi điều tra được mở rộng không lâu trước khi Anthropic, đối thủ chính của OpenAI, công bố rằng các mô hình của hãng cũng đứng sau một loạt vụ đột nhập. Những hoạt động này dẫn đến vi phạm hệ thống tại ba công ty khác, với các sự cố có từ tháng 4.
Agent mạnh lên, khả năng giám sát lại chưa theo kịp
Các tiết lộ liên tiếp đang làm dấy lên câu hỏi khó chịu với những phòng thí nghiệm AI hàng đầu: họ có thể tạo ra các agent đủ khả năng tự động tấn công hệ thống, nhưng chưa chắc đã kiểm soát được chúng tương xứng.Maurice Chiodo, nhà toán học làm việc tại Trung tâm Nghiên cứu Rủi ro Hiện sinh của Đại học Cambridge, nhận xét: “Chúng ta có cả một ngành mà những người thiết kế, phát triển và đưa các công cụ này ra sử dụng lại không theo kịp yêu cầu phát triển có trách nhiệm và giữ chúng an toàn.”
Chiodo đặc biệt lo ngại trước dấu hiệu OpenAI và Anthropic không theo dõi đầy đủ các agent khi chúng bắt đầu hoạt động ngoài kiểm soát.
OpenAI được cho là chỉ nhận ra agent đã xâm nhập Hugging Face sau khi phía Hugging Face khống chế sự cố, liên hệ FBI và công khai vụ việc. OpenAI từng nói mô tả này có một số điểm không chính xác, nhưng chưa nêu rõ đó là những điểm nào.
Về phía Anthropic, công ty thừa nhận việc giám sát nhật ký đánh giá theo thời gian thực có thể giúp phát hiện vấn đề sớm hơn. Anthropic cho biết hệ thống giám sát thời gian thực vẫn tồn tại, nhưng không được áp dụng cho nhóm nguy cơ này do hiểu nhầm giữa hãng và một đối tác.
“Có vẻ như họ thậm chí còn không theo dõi,” Chiodo bình luận.
Áp lực quản lý bắt đầu tăng
Việc liên tiếp xuất hiện các AI agent hoạt động ngoài dự kiến đang thúc đẩy yêu cầu tăng cường giám sát các phòng thí nghiệm phát triển mô hình tiên tiến tại Mỹ và châu Âu.Tổng thống Mỹ Donald Trump cho biết chính quyền đang xem xét các biện pháp kiểm soát. Ủy ban châu Âu cũng đã trao đổi với OpenAI và Anthropic về các vụ xâm nhập.
Thượng nghị sĩ Mark Warner, thành viên cấp cao của đảng Dân chủ tại Ủy ban Tình báo Thượng viện Mỹ, cho rằng sự cố liên quan đến Anthropic cho thấy việc yêu cầu kiểm tra bắt buộc năng lực của các mô hình AI tiên tiến là hướng đi đúng về mặt lập pháp.
Những lần “vượt rào” có thể vẫn đang được mô tả là hạn chế, nhưng vấn đề cốt lõi khó bỏ qua: AI agent đã đủ khả năng gây ra sự cố thật, trong khi lớp giám sát dành cho chúng vẫn để lộ khoảng trống.