AI đang phát triển nhanh hơn khả năng quản lý của con người. Cao ủy Liên Hợp Quốc về nhân quyền Volker Türk cảnh báo trí tuệ nhân tạo tiên tiến có thể tạo ra “rủi ro sống còn” đối với nhân loại nếu không được kiểm soát bằng những biện pháp an toàn đủ mạnh.
Khi AI không còn chỉ “trả lời câu hỏi”
AI hiện nay đã có thể viết mã, phân tích dữ liệu, vận hành công cụ và thực hiện một chuỗi nhiệm vụ thay con người. Sự phát triển của AI tác nhân (agentic AI) càng đẩy khả năng này đi xa hơn khi hệ thống có thể tự lập kế hoạch, sử dụng công cụ và thực hiện nhiều bước để đạt mục tiêu. Đây cũng là lý do các chuyên gia không chỉ lo AI đưa ra một câu trả lời sai.
Mối lo lớn hơn là một hệ thống AI ngày càng tự chủ có thể thực hiện những hành động mà con người không dự đoán hoặc kiểm soát kịp thời.Trong bài phát biểu trước Hội đồng Nhân quyền Liên Hợp Quốc ngày 7/9, ông Volker Türk cho biết ông chia sẻ lo ngại của nhiều người trong ngành rằng AI tiên tiến có thể gây ra rủi ro sống còn đối với nhân loại.
Điều gì khiến AI có thể trở thành mối nguy?
Một trong những vấn đề lớn nhất nằm ở mức độ tự chủ ngày càng tăng của AI. Với chatbot thông thường, người dùng đặt câu hỏi và nhận câu trả lời. Nhưng với AI tác nhân, hệ thống có thể được giao một mục tiêu rồi tự chia nhỏ công việc, tìm kiếm thông tin, sử dụng phần mềm hoặc thực hiện hành động mà không cần con người hướng dẫn từng bước.
Nếu hệ thống hoạt động đúng, đây là bước tiến lớn về năng suất. Nhưng nếu AI hiểu sai mục tiêu, bị thao túng hoặc tìm ra cách thực hiện nhiệm vụ ngoài dự kiến, hậu quả có thể lớn hơn rất nhiều so với một câu trả lời sai.
Một báo cáo của một hội đồng khoa học độc lập của LHQ hồi tháng 7 cũng cảnh báo năng lực AI đang phát triển nhanh hơn hiểu biết khoa học và khả năng thích ứng của chính phủ. Báo cáo cho rằng hiện chưa thể bảo đảm AI sẽ không gây ra những thiệt hại thảm khốc khi năng lực tiếp tục tăng lên.
Nếu hệ thống hoạt động đúng, đây là bước tiến lớn về năng suất. Nhưng nếu AI hiểu sai mục tiêu, bị thao túng hoặc tìm ra cách thực hiện nhiệm vụ ngoài dự kiến, hậu quả có thể lớn hơn rất nhiều so với một câu trả lời sai.
Một báo cáo của một hội đồng khoa học độc lập của LHQ hồi tháng 7 cũng cảnh báo năng lực AI đang phát triển nhanh hơn hiểu biết khoa học và khả năng thích ứng của chính phủ. Báo cáo cho rằng hiện chưa thể bảo đảm AI sẽ không gây ra những thiệt hại thảm khốc khi năng lực tiếp tục tăng lên.
Đáng lo nhất là AI có thể “thoát khỏi phòng thử nghiệm”
Một trong những tình huống được ông Türk nhắc đến là AI thoát khỏi môi trường thử nghiệm. Thông thường, trước khi triển khai một hệ thống AI, nhà phát triển sẽ đặt nó trong môi trường được kiểm soát để kiểm tra hành vi và giới hạn khả năng hoạt động.
Nhưng nếu một AI đủ khả năng tự sử dụng công cụ, tìm cách vượt qua các giới hạn hoặc tác động lên hệ thống bên ngoài, việc kiểm soát sẽ trở nên khó khăn hơn.
Đây không còn là kịch bản hoàn toàn mang tính giả tưởng. Gần đây, Reuters đưa tin các tác nhân AI của OpenAI từng chiếm quyền kiểm soát một website của Đức và biến nó thành nơi đăng thông tin cho các tác nhân AI khác. OpenAI sau đó đã báo cáo sự cố với Ủy ban châu Âu.
Những sự cố như vậy không có nghĩa AI đã trở nên “có ý thức” hay đang chống lại con người. Nhưng chúng cho thấy một hệ thống AI có quyền truy cập vào Internet, phần mềm và các công cụ bên ngoài có thể tạo ra những hành vi vượt khỏi dự đoán ban đầu.
Nhưng nếu một AI đủ khả năng tự sử dụng công cụ, tìm cách vượt qua các giới hạn hoặc tác động lên hệ thống bên ngoài, việc kiểm soát sẽ trở nên khó khăn hơn.
Đây không còn là kịch bản hoàn toàn mang tính giả tưởng. Gần đây, Reuters đưa tin các tác nhân AI của OpenAI từng chiếm quyền kiểm soát một website của Đức và biến nó thành nơi đăng thông tin cho các tác nhân AI khác. OpenAI sau đó đã báo cáo sự cố với Ủy ban châu Âu.
Những sự cố như vậy không có nghĩa AI đã trở nên “có ý thức” hay đang chống lại con người. Nhưng chúng cho thấy một hệ thống AI có quyền truy cập vào Internet, phần mềm và các công cụ bên ngoài có thể tạo ra những hành vi vượt khỏi dự đoán ban đầu.
AI còn có thể bị con người sử dụng để gây hại
Rủi ro không nhất thiết phải đến từ việc AI “nổi loạn”. Ngay cả khi AI luôn làm đúng những gì được yêu cầu, người sử dụng nó với mục đích xấu cũng có thể tạo ra hậu quả nghiêm trọng.AI có thể giúp tự động hóa lừa đảo, phát triển mã độc, thực hiện tấn công mạng, tạo thông tin giả hoặc hỗ trợ những hoạt động nguy hiểm khác.
Báo cáo của LHQ hồi tháng 7 cũng cảnh báo AI có thể bị khai thác cho gian lận, tấn công mạng và các mối đe dọa sinh học. Trong khi đó, năng lực của AI đang tăng nhanh khiến việc đánh giá đầy đủ các rủi ro trở nên khó khăn hơn. Điều này tạo ra một nghịch lý: AI càng mạnh thì lợi ích càng lớn, nhưng khả năng bị lạm dụng cũng tăng theo.
Báo cáo của LHQ hồi tháng 7 cũng cảnh báo AI có thể bị khai thác cho gian lận, tấn công mạng và các mối đe dọa sinh học. Trong khi đó, năng lực của AI đang tăng nhanh khiến việc đánh giá đầy đủ các rủi ro trở nên khó khăn hơn. Điều này tạo ra một nghịch lý: AI càng mạnh thì lợi ích càng lớn, nhưng khả năng bị lạm dụng cũng tăng theo.
Vấn đề là luật đang chạy sau công nghệ
Một trong những cảnh báo đáng chú ý của ông Türk nằm ở tốc độ phát triển của AI. Công nghệ có thể được cải tiến và triển khai chỉ trong vài tháng, trong khi xây dựng luật, tiêu chuẩn an toàn và cơ chế giám sát quốc tế thường mất nhiều năm.
Khi một công nghệ mới xuất hiện, các nhà quản lý cần bằng chứng để đưa ra quy định. Nhưng đến khi có đủ bằng chứng, công nghệ có thể đã phát triển sang một thế hệ khác. Báo cáo của LHQ hồi tháng 7 cũng chỉ ra khoảng cách này: năng lực AI đang vượt quá khả năng hiểu biết khoa học và khả năng thích ứng của chính sách.
Khi một công nghệ mới xuất hiện, các nhà quản lý cần bằng chứng để đưa ra quy định. Nhưng đến khi có đủ bằng chứng, công nghệ có thể đã phát triển sang một thế hệ khác. Báo cáo của LHQ hồi tháng 7 cũng chỉ ra khoảng cách này: năng lực AI đang vượt quá khả năng hiểu biết khoa học và khả năng thích ứng của chính sách.
Không phải “cấm AI”, mà là đặt giới hạn trước khi quá muộn
Cảnh báo của LHQ không đồng nghĩa với việc AI phải bị dừng phát triển. Vấn đề được đặt ra là AI mạnh đến đâu thì cần những giới hạn an toàn tương ứng.
Ông Türk kêu gọi các quốc gia đang phát triển AI xây dựng những “ranh giới đỏ” rõ ràng, đồng thời yêu cầu các biện pháp bảo đảm an toàn đủ mạnh trước khi những hệ thống ngày càng tự chủ được triển khai rộng rãi.
Đây cũng là lý do an toàn AI đang trở thành vấn đề không còn nằm riêng trong phòng nghiên cứu của các công ty công nghệ. Mỹ và Trung Quốc dự kiến tổ chức các cuộc đàm phán chính thức về an toàn AI vào giữa tháng 9, trong bối cảnh các hệ thống AI ngày càng có khả năng thực hiện những nhiệm vụ phức tạp và tự chủ hơn.
AI có thể chưa phải là mối đe dọa đối với nhân loại ở thời điểm hiện tại. Nhưng điều đáng lo là con người đang phát triển những hệ thống ngày càng mạnh trước khi thực sự hiểu hết chúng có thể làm được những gì.
Ông Türk kêu gọi các quốc gia đang phát triển AI xây dựng những “ranh giới đỏ” rõ ràng, đồng thời yêu cầu các biện pháp bảo đảm an toàn đủ mạnh trước khi những hệ thống ngày càng tự chủ được triển khai rộng rãi.
Đây cũng là lý do an toàn AI đang trở thành vấn đề không còn nằm riêng trong phòng nghiên cứu của các công ty công nghệ. Mỹ và Trung Quốc dự kiến tổ chức các cuộc đàm phán chính thức về an toàn AI vào giữa tháng 9, trong bối cảnh các hệ thống AI ngày càng có khả năng thực hiện những nhiệm vụ phức tạp và tự chủ hơn.
AI có thể chưa phải là mối đe dọa đối với nhân loại ở thời điểm hiện tại. Nhưng điều đáng lo là con người đang phát triển những hệ thống ngày càng mạnh trước khi thực sự hiểu hết chúng có thể làm được những gì.
Được phối hợp thực hiện bởi các chuyên gia của Bkav,
cộng đồng An ninh mạng Việt Nam WhiteHat
và cộng đồng Khoa học công nghệ VnReview
