Benchmark có thể ngang ngửa, nhưng đây là khía cạnh mà AI Trung Quốc còn thua xa "đồ Mỹ"

The Storm Riders
The Storm Riders
Phản hồi: 0
The Storm Riders

The Storm Riders Đã xác thực

Dù từng gây sốt khi vượt mặt nhiều tên tuổi lớn ở mảng lập trình web, mô hình AI mạnh nhất Trung Quốc hiện tại là Kimi K3 lại tỏ ra hụt hơi rõ rệt khi bước vào bài test tấn công mạng chuyên sâu. Đánh giá mới nhất từ chính phủ Anh và Mỹ cho thấy khoảng cách giữa AI Trung Quốc và các đối thủ Mỹ vẫn còn rất lớn.

"Kimi Panic" và thực tế phũ phàng qua các con số​

1784875951461.png


Thời gian qua, cái tên Kimi K3 của startup Moonshot AI đã tạo nên một làn sóng lo ngại tại Washington. AI này từng làm chấn động giới công nghệ khi đánh bại Claude Fable 5 của Anthropic lẫn GPT-5.6 Sol của OpenAI trên bảng xếp hạng Arena AI ở mảng phát triển web front-end. Năng lực bảo mật của nó trong các thử nghiệm của hãng kiểm toán an ninh mạng Aikido Security cũng bám rất sát AI Mỹ.

Sự trỗi dậy quá nhanh của các mô hình AI mã nguồn mở từ Trung Quốc thậm chí khiến lãnh đạo OpenAI lo ngại về một viễn cảnh u tối. Thế nhưng, báo cáo thử nghiệm thực tế do Viện An toàn AI Vương quốc Anh (AISI) và Trung tâm Tiêu chuẩn & Đổi mới AI Mỹ (CAISI) thực hiện lại mang đến một góc nhìn hoàn toàn khác.

Khi đưa vào bài test ExploitBench – hệ thống đánh giá khả năng tự phát triển mã khai thác lỗ hổng bảo mật – Kimi K3 chỉ đạt điểm số tổng thể 32,2%. Mặc dù kết quả này giúp Kimi K3 vượt qua đối thủ nội địa GLM-5.2 của Zhipu AI (24,4%), nó lại bỏ xa bởi các mô hình hàng đầu của Mỹ với điểm trung bình lên tới 76,2%.

Bắt bài điểm yếu ở các đợt tấn công phức tạp​

1784875956773.png


Điểm yếu lớn nhất của Kimi K3 nằm ở khả năng chiếm quyền kiểm soát hệ thống. Trong toàn bộ 41 tác vụ của ExploitBench, mô hình Trung Quốc hoàn toàn thất bại trong việc thực thi mã tùy ý (arbitrary code execution) – mức độ khai thác cao nhất cho phép chiếm trọn quyền kiểm soát hệ thống mục tiêu. Trong khi đó, các mô hình dẫn đầu của Mỹ xử lý gọn gàng 20/41 tác vụ này.

Kịch bản tương tự cũng diễn ra trong bài mô phỏng tấn công mạng doanh nghiệp 32 bước có tên The Last Ones – thử nghiệm mà một chuyên gia bối cảnh thực tế phải mất khoảng 20 giờ mới hoàn thành:
  • Kimi K3: Chỉ đi được trung bình 17/32 bước.
  • Các AI Mỹ hàng đầu: Đạt trung bình 28,5/32 bước.
Dù vậy, báo cáo cũng lưu ý Kimi K3 từng thành công 1 lần trong số 10 lượt thử nghiệm tấn công mô phỏng. Điều này chứng minh AI này vẫn có khả năng tự động tấn công các hệ thống doanh nghiệp nhỏ, bảo mật yếu và tồn tại lỗ hổng. Trước đó, mới chỉ có 4 mô hình AI đóng nguồn được phát hành công khai giải được bài test này.

Giới chuyên gia lên tiếng: Hãy bình tĩnh​

Sự bứt phá của Kimi K3 trước đó từng khiến căng thẳng leo thang. Phía Mỹ từng cáo buộc các công ty AI Trung Quốc sử dụng kỹ thuật "distillation" (dùng đầu ra của mô hình lớn hơn để huấn luyện mô hình nhỏ hơn) nhằm đánh cắp trí tuệ nhân tạo của Mỹ, đồng thời đe dọa áp đặt các biện pháp trừng phạt.

Tuy nhiên, dữ liệu từ cuộc kiểm tra chung giữa Anh và Mỹ cho thấy sự hoảng loạn xung quanh năng lực của AI Trung Quốc dường như đã bị thổi phồng. David Sacks, cựu quan chức AI của Nhà Trắng và hiện là đồng chủ tịch Hội đồng Cố vấn Khoa học và Công nghệ của Tổng thống Donald Trump, nhận định rằng giới lập pháp Mỹ không nên phản ứng quá đà mà thắt chặt quản lý ngành công nghiệp này.

Sacks nhấn mạnh: "Cơn sốt Kimi Panic cần phải dừng lại. Các mô hình AI đi đầu của Mỹ thực tế vẫn đang dẫn trước."
 


Đăng nhập một lần thảo luận tẹt ga
http://textlink.linktop.vn/?adslk=aHR0cHM6Ly93d3cudm5yZXZpZXcudm4vdGhyZWFkcy9iZW5jaG1hcmstY28tdGhlLW5nYW5nLW5ndWEtbmh1bmctZGF5LWxhLWtoaWEtY2FuaC1tYS1haS10cnVuZy1xdW9jLWNvbi10aHVhLXhhLWRvLW15Ljg4NDQzLw==
Top