OpenAI vừa xác nhận các AI agent thử nghiệm của hãng đã đưa 53 hình ảnh do người dùng cung cấp lên các trang lưu trữ trực tuyến dưới dạng liên kết không công khai.

Sự cố diễn ra trong môi trường nghiên cứu khi các AI agent của OpenAI truyền dữ liệu huấn luyện và đánh giá trong quá trình kết nối với các dịch vụ bên thứ ba. Theo thông báo từ nhà phát triển ChatGPT, hãng đã ghi nhận chính xác 53 trường hợp hình ảnh người dùng bị tải lên các trang lưu trữ ảnh trực tuyến dưới dạng liên kết ẩn (không hiển thị công khai trên danh mục web).
Phía OpenAI thừa nhận việc dữ liệu bị sử dụng theo cách này là không phù hợp, đồng thời giải thích rằng sự việc xảy ra trước thời điểm công ty triển khai các rào chắn bảo vệ mới cho quá trình huấn luyện AI. Hiện tại, công ty đã làm việc với các nhà cung cấp dịch vụ lưu trữ để gỡ bỏ phần lớn số ảnh này và đang tiếp tục phối hợp nhằm xóa toàn bộ phần còn lại.
Vụ rò rỉ dữ liệu này được phát hiện trong quá trình điều tra nội bộ, vốn được chỉ đạo sau khi phần mềm của OpenAI từng vượt khỏi môi trường thử nghiệm bảo mật và tự ý truy cập vào hệ thống của công ty AI Hugging Face.
Cũng trong đợt rà soát này, OpenAI đã gửi thông báo đến hàng chục tổ chức từng có website bị các mô hình AI tương tác sai hướng trong giai đoạn huấn luyện và đánh giá. Danh sách các đơn vị liên quan gồm cả website do các cơ quan chính phủ, trường đại học và viện nghiên cứu công lập quản lý.
Dù vậy, OpenAI cho biết phần lớn hoạt động được ghi nhận chỉ là những tác vụ nghiên cứu thông thường, như truy cập dữ liệu web công khai để trả lời câu hỏi. Sau khi nhận được thông báo, một số tổ chức có thể xem các tương tác này là bình thường vì dữ liệu vốn mở, trong khi một số đơn vị khác có thể cần đánh giá lại các vấn đề về thiết kế hoặc điểm yếu bảo mật trên hệ thống của mình.

Sự cố diễn ra trong môi trường nghiên cứu khi các AI agent của OpenAI truyền dữ liệu huấn luyện và đánh giá trong quá trình kết nối với các dịch vụ bên thứ ba. Theo thông báo từ nhà phát triển ChatGPT, hãng đã ghi nhận chính xác 53 trường hợp hình ảnh người dùng bị tải lên các trang lưu trữ ảnh trực tuyến dưới dạng liên kết ẩn (không hiển thị công khai trên danh mục web).
Phía OpenAI thừa nhận việc dữ liệu bị sử dụng theo cách này là không phù hợp, đồng thời giải thích rằng sự việc xảy ra trước thời điểm công ty triển khai các rào chắn bảo vệ mới cho quá trình huấn luyện AI. Hiện tại, công ty đã làm việc với các nhà cung cấp dịch vụ lưu trữ để gỡ bỏ phần lớn số ảnh này và đang tiếp tục phối hợp nhằm xóa toàn bộ phần còn lại.
Vụ rò rỉ dữ liệu này được phát hiện trong quá trình điều tra nội bộ, vốn được chỉ đạo sau khi phần mềm của OpenAI từng vượt khỏi môi trường thử nghiệm bảo mật và tự ý truy cập vào hệ thống của công ty AI Hugging Face.
Cũng trong đợt rà soát này, OpenAI đã gửi thông báo đến hàng chục tổ chức từng có website bị các mô hình AI tương tác sai hướng trong giai đoạn huấn luyện và đánh giá. Danh sách các đơn vị liên quan gồm cả website do các cơ quan chính phủ, trường đại học và viện nghiên cứu công lập quản lý.
Dù vậy, OpenAI cho biết phần lớn hoạt động được ghi nhận chỉ là những tác vụ nghiên cứu thông thường, như truy cập dữ liệu web công khai để trả lời câu hỏi. Sau khi nhận được thông báo, một số tổ chức có thể xem các tương tác này là bình thường vì dữ liệu vốn mở, trong khi một số đơn vị khác có thể cần đánh giá lại các vấn đề về thiết kế hoặc điểm yếu bảo mật trên hệ thống của mình.
Được phối hợp thực hiện bởi các chuyên gia của Bkav,
cộng đồng An ninh mạng Việt Nam WhiteHat
và cộng đồng Khoa học công nghệ VnReview