AI cũng biết 'hùa theo' số đông

K
Kaya
Phản hồi: 0
  • Thread starter Thread starter Kaya
  • Ngày gửi Ngày gửi

Kaya

Writer
Một nghiên cứu mới sẽ khiến ai trong số chúng ta cũng phải ngạc nhiên, chú ý bởi AI cũng có thể bị ảnh hưởng bởi “số đông”. Các nhà nghiên cứu phát hiện những nhóm tác nhân AI có xu hướng dần nghiêng về một lựa chọn chung, dù không được yêu cầu phải đồng thuận, không có thủ lĩnh và cũng chẳng nhận phần thưởng nào cho việc đưa ra cùng một câu trả lời.

Nhóm nghiên cứu do Giordano De Marzo, nhà khoa học xã hội tính toán tại Đại học Konstanz (Đức), thực hiện thí nghiệm với các tác nhân dựa trên 10 mô hình thuộc ba họ GPT, Claude và Llama. Các AI được cho tham gia nhiều vòng lựa chọn nhưng không có ký ức về những vòng trước. Điều đáng chú ý là chỉ cần ban đầu xuất hiện một chênh lệch nhỏ, chẳng hạn một phương án được nhiều tác nhân lựa chọn hơn, sự chênh lệch này có thể tiếp tục lớn dần qua các vòng và cuối cùng kéo cả nhóm về cùng một lựa chọn.
ad7e5cd6-aae3-4c09-9cc3-3125292a8c2a.png

Nghe qua thì chuyện AI “hùa theo” có vẻ khá giống cách con người đôi khi bị ảnh hưởng bởi đám đông. Nhưng nếu đặt nó trong bối cảnh AI đang ngày càng được đưa vào những hệ thống quan trọng, vấn đề lại trở nên đáng suy nghĩ hơn. Một AI đưa ra quyết định dựa trên thông tin sai đã là một chuyện; nhiều AI cùng tham khảo, phản hồi và điều chỉnh theo nhau rồi cùng đi đến một kết luận sai có thể tạo ra một vấn đề lớn hơn nhiều.

Đặc biệt, khi các AI agent trong tương lai không còn chỉ trả lời câu hỏi mà có thể tự tìm kiếm thông tin, sử dụng công cụ, trao đổi với những tác nhân khác và thực hiện hành động, hiện tượng này cần được xem xét nghiêm túc. Nếu một tác nhân tiếp nhận thông tin từ một tác nhân khác mà không kiểm chứng nguồn gốc, rồi tác nhân thứ ba lại coi câu trả lời đó như một nguồn đáng tin cậy, thông tin sai có thể nhanh chóng tạo thành một vòng lặp tự củng cố.

Hãy thử hình dung một hệ thống phòng thủ có nhiều AI cùng tham gia phân tích một cuộc tấn công. Nếu một AI ban đầu nhận định nhầm một tệp tin là an toàn, những AI khác có thể tham khảo kết quả đó và dần hình thành cùng một nhận định. Khi tất cả cùng đồng ý, con người rất dễ có cảm giác rằng kết luận đó đã được “nhiều hệ thống xác nhận”, trong khi thực tế chúng có thể chỉ đang xác nhận lẫn nhau.

Điều ngược lại cũng có thể xảy ra với tội phạm mạng. Một kẻ tấn công trong tương lai có thể không cần tìm cách đánh lừa từng AI một. Chỉ cần đưa một thông tin hoặc tín hiệu sai vào đúng một vị trí trong chuỗi tương tác, thông tin đó có khả năng được các tác nhân khác tiếp nhận, nhắc lại và củng cố. Khi mạng lưới AI càng lớn, việc phân biệt đâu là thông tin gốc, đâu là thông tin đã được các AI khác “nhai lại” có thể trở thành một bài toán an ninh mới.

Điều này cũng khiến khái niệm “AI đồng thuận” cần được nhìn khác đi. Nhiều người có thể nghĩ rằng nếu năm hay mười AI cùng đưa ra một câu trả lời giống nhau thì câu trả lời đó chắc chắn đáng tin hơn. Nhưng nghiên cứu này lại gợi ra một câu hỏi ngược lại: chúng thực sự độc lập đưa ra cùng một kết luận, hay chỉ đang quan sát nhau và cùng đi về một phía?

Có lẽ đây cũng là một trong những lý do các hệ thống AI trong tương lai không thể chỉ được đánh giá bằng độ chính xác của từng mô hình riêng lẻ. Khi nhiều AI bắt đầu làm việc cùng nhau, chúng ta còn phải quan tâm đến cách chúng trao đổi thông tin, nguồn thông tin nào được ưu tiên, khả năng kiểm chứng chéo và cơ chế phát hiện khi cả hệ thống cùng mắc một sai lầm.

AI càng trở nên “xã hội” hơn, càng có khả năng giao tiếp và phối hợp với những AI khác, thì việc chúng có thể ảnh hưởng lẫn nhau sẽ càng đáng quan tâm. Một AI biết lắng nghe có thể là điều tốt; nhưng một hệ thống gồm hàng trăm AI cùng nghe nhau rồi cùng tin vào một điều sai thì lại là một câu chuyện hoàn toàn khác.

Và có lẽ câu hỏi đáng đặt ra không còn là “AI có thông minh không?” mà sẽ là: nếu AI cũng có thể bị ảnh hưởng bởi số đông, chúng ta sẽ làm gì khi cả một hệ thống AI cùng tin vào một điều sai?​
 
Được phối hợp thực hiện bởi các chuyên gia của Bkav, cộng đồng An ninh mạng Việt Nam WhiteHat và cộng đồng Khoa học công nghệ VnReview
Back
Top