Derpy✔
Intern Writer
Trí tuệ nhân tạo đang ngày càng chứng tỏ sức mạnh đáng kinh ngạc, nhưng cũng đặt ra những câu hỏi lớn về an toàn và kiểm soát. Mới đây, ngày 8 tháng 8, OpenAI đã công bố một bước tiến đột phá nhưng cũng đầy thách thức: mô hình sắp ra mắt của họ, Astra, đã đạt được những thành tựu đáng kể trong lập trình tác nhân (agent programming) và đặc biệt là an ninh mạng.
Điều khiến cộng đồng công nghệ phải chú ý là Astra đã trở thành mô hình đầu tiên của OpenAI được xếp vào mức rủi ro "Critical" (Cực kỳ nghiêm trọng) trong lĩnh vực an ninh mạng, theo Khung chuẩn bị (Preparedness Framework) nội bộ của công ty. Để hình dung rõ hơn về mức độ "nghiêm trọng" này, một mô hình AI sẽ chạm ngưỡng "Critical" nếu nó có thể tự mình thực hiện một trong hai điều sau:
Không cần sự can thiệp của con người, Astra có khả năng tìm kiếm và khai thác các lỗ hổng zero-day (những lỗ hổng chưa từng được biết đến) trên nhiều hệ thống quan trọng, đã được tăng cường bảo mật. Nó có thể phát triển các chương trình khai thác hiệu quả cho các lỗ hổng này, bất kể mức độ nghiêm trọng.

Hoặc, chỉ với một mục tiêu chiến lược cấp cao, Astra có thể tự chủ lên kế hoạch và thực hiện các cuộc tấn công mạng từ đầu đến cuối, nhắm vào các mục tiêu đã được bảo vệ chặt chẽ.
OpenAI cũng nhanh chóng làm rõ rằng Astra là một mô hình chưa được phát hành và hoàn toàn không liên quan đến bất kỳ sự cố tấn công mạng nào trước đây, chẳng hạn như vụ việc nhắm vào Hugging Face.
Trước những khả năng mạnh mẽ nhưng cũng tiềm ẩn rủi ro này, OpenAI đã công bố một loạt các biện pháp kiểm soát nghiêm ngặt để đảm bảo quá trình phát triển tiếp theo diễn ra an toàn và tuân thủ. Họ đang áp dụng các biện pháp bảo mật chặt chẽ hơn cho các mô hình có năng lực cao và các hoạt động nghiên cứu phát triển liên quan. Điều này bao gồm việc thiết lập môi trường thử nghiệm biệt lập, hạn chế quyền truy cập mạng và công cụ, tăng cường bảo vệ và mã hóa trọng số mô hình, triển khai khả năng giám sát và phát hiện bổ sung, cùng với việc chạy mô hình trong môi trường "sandbox" (hộp cát) an toàn. Thậm chí, mọi hoạt động nội bộ liên quan đến Astra mà chưa đáp ứng các tiêu chuẩn bảo mật tăng cường này đều đã bị tạm dừng.
Bên cạnh đó, OpenAI cũng thực hiện giám sát toàn cầu đối với tất cả các ứng dụng tác nhân của Astra, bao gồm cả giai đoạn huấn luyện và đánh giá, để phát hiện các hành vi rủi ro cao và những lỗi căn chỉnh. Họ sẽ xem xét chuỗi suy nghĩ (Chain of Thought - CoT) của mô hình để đánh giá và chặn các hoạt động có nguy cơ cao.
Để đảm bảo tính khách quan và an toàn tối đa, OpenAI còn hợp tác chặt chẽ với các cơ quan chính phủ và các tổ chức an toàn AI chuyên biệt để cùng thử nghiệm mô hình này. Họ cũng cung cấp các khuyến nghị về kiểm soát an toàn cho các đối tác thử nghiệm bên thứ ba, nhằm đảm bảo rằng các đánh giá và khối lượng công việc có rủi ro cao hơn có thể được thực hiện trong một trạng thái an toàn.
Sam Altman, CEO của OpenAI, đã chia sẻ về Astra với sự hào hứng nhưng cũng đầy thận trọng. Anh ấy khẳng định Astra là một mô hình cực kỳ mạnh mẽ và công ty đang nỗ lực hết mình để sớm công bố rộng rãi. Altman tin rằng việc giữ những mô hình hàng đầu trong tay một số ít người không phải là một chiến lược tốt. Tuy nhiên, anh cũng nhấn mạnh rằng, với khả năng vượt trội trong an ninh mạng của Astra, họ cần thêm thời gian để đảm bảo mọi thứ thật sự an toàn và không có rủi ro nào. Anh hy vọng chúng ta sẽ không phải chờ đợi quá lâu để được trải nghiệm sức mạnh của Astra.
Điều khiến cộng đồng công nghệ phải chú ý là Astra đã trở thành mô hình đầu tiên của OpenAI được xếp vào mức rủi ro "Critical" (Cực kỳ nghiêm trọng) trong lĩnh vực an ninh mạng, theo Khung chuẩn bị (Preparedness Framework) nội bộ của công ty. Để hình dung rõ hơn về mức độ "nghiêm trọng" này, một mô hình AI sẽ chạm ngưỡng "Critical" nếu nó có thể tự mình thực hiện một trong hai điều sau:
Không cần sự can thiệp của con người, Astra có khả năng tìm kiếm và khai thác các lỗ hổng zero-day (những lỗ hổng chưa từng được biết đến) trên nhiều hệ thống quan trọng, đã được tăng cường bảo mật. Nó có thể phát triển các chương trình khai thác hiệu quả cho các lỗ hổng này, bất kể mức độ nghiêm trọng.

Hoặc, chỉ với một mục tiêu chiến lược cấp cao, Astra có thể tự chủ lên kế hoạch và thực hiện các cuộc tấn công mạng từ đầu đến cuối, nhắm vào các mục tiêu đã được bảo vệ chặt chẽ.
OpenAI cũng nhanh chóng làm rõ rằng Astra là một mô hình chưa được phát hành và hoàn toàn không liên quan đến bất kỳ sự cố tấn công mạng nào trước đây, chẳng hạn như vụ việc nhắm vào Hugging Face.
Trước những khả năng mạnh mẽ nhưng cũng tiềm ẩn rủi ro này, OpenAI đã công bố một loạt các biện pháp kiểm soát nghiêm ngặt để đảm bảo quá trình phát triển tiếp theo diễn ra an toàn và tuân thủ. Họ đang áp dụng các biện pháp bảo mật chặt chẽ hơn cho các mô hình có năng lực cao và các hoạt động nghiên cứu phát triển liên quan. Điều này bao gồm việc thiết lập môi trường thử nghiệm biệt lập, hạn chế quyền truy cập mạng và công cụ, tăng cường bảo vệ và mã hóa trọng số mô hình, triển khai khả năng giám sát và phát hiện bổ sung, cùng với việc chạy mô hình trong môi trường "sandbox" (hộp cát) an toàn. Thậm chí, mọi hoạt động nội bộ liên quan đến Astra mà chưa đáp ứng các tiêu chuẩn bảo mật tăng cường này đều đã bị tạm dừng.
Bên cạnh đó, OpenAI cũng thực hiện giám sát toàn cầu đối với tất cả các ứng dụng tác nhân của Astra, bao gồm cả giai đoạn huấn luyện và đánh giá, để phát hiện các hành vi rủi ro cao và những lỗi căn chỉnh. Họ sẽ xem xét chuỗi suy nghĩ (Chain of Thought - CoT) của mô hình để đánh giá và chặn các hoạt động có nguy cơ cao.
Để đảm bảo tính khách quan và an toàn tối đa, OpenAI còn hợp tác chặt chẽ với các cơ quan chính phủ và các tổ chức an toàn AI chuyên biệt để cùng thử nghiệm mô hình này. Họ cũng cung cấp các khuyến nghị về kiểm soát an toàn cho các đối tác thử nghiệm bên thứ ba, nhằm đảm bảo rằng các đánh giá và khối lượng công việc có rủi ro cao hơn có thể được thực hiện trong một trạng thái an toàn.
Sam Altman, CEO của OpenAI, đã chia sẻ về Astra với sự hào hứng nhưng cũng đầy thận trọng. Anh ấy khẳng định Astra là một mô hình cực kỳ mạnh mẽ và công ty đang nỗ lực hết mình để sớm công bố rộng rãi. Altman tin rằng việc giữ những mô hình hàng đầu trong tay một số ít người không phải là một chiến lược tốt. Tuy nhiên, anh cũng nhấn mạnh rằng, với khả năng vượt trội trong an ninh mạng của Astra, họ cần thêm thời gian để đảm bảo mọi thứ thật sự an toàn và không có rủi ro nào. Anh hy vọng chúng ta sẽ không phải chờ đợi quá lâu để được trải nghiệm sức mạnh của Astra.