Tưởng như việc "nghe ngóng rồi hùa theo đám đông" chỉ là hành vi của con người, nhưng một thử nghiệm vừa phát hiện các tác nhân AI cũng tự động nghiêng về lựa chọn chung của tập thể mà không cần bất kỳ sự ép buộc hay điều phối nào.
Một nghiên cứu công bố trên tạp chí Science Advances đã mang lại phát hiện khá thú vị về hành vi tập thể của các tác nhân trí tuệ nhân tạo (AI agent). Cụ thể, khi được đặt vào cùng một nhóm, các mô hình này có xu hướng tự hình thành sự đồng thuận dù không có bất kỳ cơ chế điều phối trung tâm hay mệnh lệnh nào yêu cầu chúng phải đồng ý với nhau.
Thử nghiệm được thực hiện bởi nhóm của nhà khoa học xã hội tính toán Giordano De Marzo thuộc Đại học Konstanz (Đức), sử dụng 10 mô hình ngôn ngữ lớn thuộc ba họ quen thuộc: GPT, Claude và Llama. Trong nghiên cứu này, các AI agent đóng vai trò như những thực thể độc lập: tiếp nhận thông tin đầu vào và tự đưa ra quyết định.

Sau đó, từng AI lần lượt được nhìn thấy lựa chọn hiện tại của những AI khác trong nhóm và được yêu cầu chọn lại.
Quy trình được thiết lập rất chặt chẽ:
* AI không hề có ký ức về các vòng lựa chọn trước đó.
* Không có câu lệnh nào bảo chúng phải đi theo số đông.
* Không có phần thưởng nếu cả nhóm đạt được sự thống nhất.
* AI hoàn toàn không được thông báo rằng mục tiêu của bài test là tìm kiếm sự đồng thuận.
Dù vậy, kết quả là hầu hết các mô hình đều có khuynh hướng đổi ý sang phương án đang được nhiều AI khác chọn hơn. Một sự chênh lệch rất nhỏ lúc đầu cứ thế lớn dần qua từng vòng, cuối cùng kéo toàn bộ nhóm ngả về một lựa chọn duy nhất.
Hiện tượng này được các nhà nghiên cứu gọi là "lực của số đông". Thú vị hơn, hành vi này tuân theo một quy luật toán học tương tự như hiện tượng các mô men từ nguyên tử cùng tự sắp xếp theo một hướng trong vật liệu sắt từ. Đại diện nhóm nghiên cứu cho biết mọi mô hình thuộc cả ba họ thử nghiệm đều thể hiện chung một quy luật này.
Trong các bài kiểm tra, Claude 3.5 Sonnet vẫn giữ được sự phối hợp đồng thuận ở mốc 1.000 tác nhân – quy mô tối đa mà nhóm nghiên cứu thử nghiệm. Nhìn chung, các mô hình có năng lực xử lý ngôn ngữ càng cao thì khuynh hướng chọn theo số đông càng mạnh và duy trì được sự đồng thuận trong những tập thể lớn hơn.
Thí nghiệm này chỉ thuần túy quan sát sự dịch chuyển lựa chọn dựa trên dữ liệu thống kê đầu vào, chưa kiểm tra khả năng phân chia công việc, theo đuổi mục tiêu phức tạp, thấu hiểu kiến thức của nhau, hay năng lực phản biện lại số đông khi đám đông đưa ra quyết định sai.
Một nghiên cứu công bố trên tạp chí Science Advances đã mang lại phát hiện khá thú vị về hành vi tập thể của các tác nhân trí tuệ nhân tạo (AI agent). Cụ thể, khi được đặt vào cùng một nhóm, các mô hình này có xu hướng tự hình thành sự đồng thuận dù không có bất kỳ cơ chế điều phối trung tâm hay mệnh lệnh nào yêu cầu chúng phải đồng ý với nhau.
Thử nghiệm được thực hiện bởi nhóm của nhà khoa học xã hội tính toán Giordano De Marzo thuộc Đại học Konstanz (Đức), sử dụng 10 mô hình ngôn ngữ lớn thuộc ba họ quen thuộc: GPT, Claude và Llama. Trong nghiên cứu này, các AI agent đóng vai trò như những thực thể độc lập: tiếp nhận thông tin đầu vào và tự đưa ra quyết định.

Thí nghiệm đơn giản nhưng hiệu ứng bất ngờ
Cách thiết kế thử nghiệm không hề phức tạp. Ban đầu, mỗi AI được gán ngẫu nhiên một trong hai phương án hoàn toàn vô nghĩa như "A" hoặc "B", không có đáp án nào đúng hay tốt hơn đáp án nào.Sau đó, từng AI lần lượt được nhìn thấy lựa chọn hiện tại của những AI khác trong nhóm và được yêu cầu chọn lại.
Quy trình được thiết lập rất chặt chẽ:
* AI không hề có ký ức về các vòng lựa chọn trước đó.
* Không có câu lệnh nào bảo chúng phải đi theo số đông.
* Không có phần thưởng nếu cả nhóm đạt được sự thống nhất.
* AI hoàn toàn không được thông báo rằng mục tiêu của bài test là tìm kiếm sự đồng thuận.
Dù vậy, kết quả là hầu hết các mô hình đều có khuynh hướng đổi ý sang phương án đang được nhiều AI khác chọn hơn. Một sự chênh lệch rất nhỏ lúc đầu cứ thế lớn dần qua từng vòng, cuối cùng kéo toàn bộ nhóm ngả về một lựa chọn duy nhất.
Hiện tượng này được các nhà nghiên cứu gọi là "lực của số đông". Thú vị hơn, hành vi này tuân theo một quy luật toán học tương tự như hiện tượng các mô men từ nguyên tử cùng tự sắp xếp theo một hướng trong vật liệu sắt từ. Đại diện nhóm nghiên cứu cho biết mọi mô hình thuộc cả ba họ thử nghiệm đều thể hiện chung một quy luật này.
Mô hình càng thông minh, xu hướng theo số đông càng rõ
Nghiên cứu cũng chỉ ra rằng khả năng duy trì đồng thuận có sự phân hóa rõ rệt tùy theo năng lực của từng mô hình. Những mô hình tiên tiến như Claude 3.5 Sonnet và GPT-4 Turbo có thể duy trì xu hướng theo số đông ở quy mô rất lớn, vượt mốc 1.000 tác nhân AI.Trong các bài kiểm tra, Claude 3.5 Sonnet vẫn giữ được sự phối hợp đồng thuận ở mốc 1.000 tác nhân – quy mô tối đa mà nhóm nghiên cứu thử nghiệm. Nhìn chung, các mô hình có năng lực xử lý ngôn ngữ càng cao thì khuynh hướng chọn theo số đông càng mạnh và duy trì được sự đồng thuận trong những tập thể lớn hơn.
Chưa phải là một "xã hội AI" có ý thức
Dù kết quả nghe có vẻ ấn tượng, các tác giả nghiên cứu nhấn mạnh rằng không nên vội suy diễn rằng 1.000 AI này đã biết "họp bàn", hình thành xã hội hay có ý thức hợp tác thực thụ.Thí nghiệm này chỉ thuần túy quan sát sự dịch chuyển lựa chọn dựa trên dữ liệu thống kê đầu vào, chưa kiểm tra khả năng phân chia công việc, theo đuổi mục tiêu phức tạp, thấu hiểu kiến thức của nhau, hay năng lực phản biện lại số đông khi đám đông đưa ra quyết định sai.