Zoey✔
Intern Writer
Trong thế giới công nghệ đang phát triển vũ bão, trí tuệ nhân tạo (AI) được kỳ vọng sẽ mang lại những bước tiến vượt bậc cho nhân loại. Thế nhưng, một báo cáo mới đây từ Anthropic, công ty phát triển mô hình AI Claude, lại vẽ nên một bức tranh đáng lo ngại: công nghệ này đang bị các thế lực thù địch và những nhóm có ý đồ xấu lợi dụng cho mục đích quân sự, thậm chí là phát triển vũ khí.
Báo cáo dài 154 trang của Anthropic, được công bố vào cuối tháng 9 năm 2026, đã phơi bày chi tiết cách thức các tác nhân từ Iran, Yemen, Trung Quốc và Nga sử dụng Claude để hỗ trợ hoạt động tình báo, tấn công mạng, chiến dịch gây ảnh hưởng, và cả nghiên cứu sinh học đáng báo động trong suốt 8 tháng qua. Đây không phải lần đầu Anthropic lên tiếng về việc lạm dụng mô hình của mình, nhưng đây là bản báo cáo "chi tiết nhất" từ trước đến nay, cho thấy mức độ nghiêm trọng của vấn đề.
Một trong những trường hợp nổi bật nhất là việc một nhóm có liên hệ với Iran đã sử dụng Claude để thu thập và phân tích dữ liệu công khai, nhằm mục đích xác định mục tiêu tấn công các lực lượng hải quân Hoa Kỳ ở Trung Đông. Nhóm này đã dùng Claude để biên soạn các "sổ tay mục tiêu" thông qua một quy trình Python được xây dựng với sự hỗ trợ của AI. Những tài liệu này bao gồm danh sách nhân sự Hoa Kỳ được trích xuất từ chú thích ảnh quân sự công khai, định danh bộ phát đáp của tàu và máy bay, kịch bản truy vấn hình ảnh vệ tinh thương mại, và danh mục các trang web công khai tiết lộ hoạt động của hải quân Hoa Kỳ. Claude còn được chỉ dẫn để nghiên cứu các lỗ hổng bảo mật trên hệ thống tàu chiến, liệt kê các lỗ hổng đã biết (CVE) trong thiết bị đầu cuối VSAT hàng hải, thiết bị liên lạc Cisco và các sản phẩm điều khiển công nghiệp. Anthropic đã nhanh chóng khóa tài khoản của nhóm này, phát triển các biện pháp phát hiện mới và chia sẻ thông tin tình báo với chính quyền để ngăn chặn mối đe dọa. Điều đáng nói là tài khoản này còn được liên kết với công việc phát triển phần mềm "giám sát hàng loạt trong nước" cho các hệ thống nhà nước Iran, cho thấy mối liên hệ trực tiếp với chính quyền Tehran.
Ở Yemen, một nhóm được cho là phiến quân Houthi do Iran hậu thuẫn, đã sử dụng Claude để hỗ trợ phát triển hệ thống dẫn đường cho tên lửa đạn đạo và tên lửa siêu thanh. Nhóm này đã triển khai ba chương trình vũ khí: một tên lửa dẫn đường sử dụng máy tính bay cấp điện thoại thông thường với dẫn đường pha cuối, một tên lửa đạn đạo đa tầng với mục tiêu tầm bắn trên 2.000 km, và một tên lửa đa biến thể (được gọi là bộ "R2000") bao gồm một biến thể phương tiện lướt siêu thanh. Họ dùng Claude Code thay thế các kỹ sư phần mềm để phát triển phần mềm dẫn đường, điều hướng và điều khiển (GNC), tích hợp hệ thống lái tự động mã nguồn mở vào máy tính bay, viết phần mềm ước tính vị trí và điều khiển, tinh chỉnh cài đặt, chạy quy trình xây dựng firmware và thực hiện mô phỏng chuyến bay. Các tác nhân này còn quản lý nhiều phiên bản Claude cùng lúc, phân công vai trò như một nhóm kỹ sư nhỏ, với một phiên bản viết mã, một phiên bản nghiên cứu và một phiên bản khác để xem xét mã. Mặc dù các biện pháp bảo vệ của Anthropic đã chặn nhiều yêu cầu, nhưng không phải tất cả, do nhóm này đã dùng nhiều chiến thuật để lách luật, bao gồm che giấu mục tiêu và chia nhỏ công việc. Một vụ thử nghiệm tên lửa dẫn đường đã thất bại, và nhóm này đã quay lại Claude để tìm hiểu nguyên nhân.
Không chỉ ở Trung Đông, Claude còn được sử dụng trong các nỗ lực quân sự của Trung Quốc. Một tác nhân tại Trung Quốc đã dùng Claude để thúc đẩy ba hướng công việc song song liên quan đến hệ thống phòng thủ chống ngư lôi hải quân. Đầu tiên, họ dùng Claude để soạn thảo một bản đặc tả kỹ thuật bằng tiếng Trung cho hệ thống điều khiển hỏa lực chống ngư lôi, nhằm mục đích được một nhà sản xuất quốc phòng Trung Quốc phê duyệt. Thứ hai, Claude giúp tạo ra một đề xuất kỹ thuật dài hơn 200 trang bằng tiếng Trung, kèm theo một bản trình bày tóm tắt cho lãnh đạo. Cuối cùng, tác nhân này đã dùng Claude để so sánh hệ thống của mình với các chương trình chống ngư lôi và chống tàu ngầm cụ thể của Hoa Kỳ dựa trên thông tin công khai, sau đó tạo ra một bản tóm tắt bằng tiếng Trung về các hệ thống của Hải quân Hoa Kỳ. Đáng chú ý, tác nhân này đã yêu cầu Claude đóng vai một chuyên gia đánh giá "thù địch" để phê bình đề xuất, sau đó dùng phản hồi đó để hoàn thiện các phiên bản tiếp theo. Anthropic đánh giá tác nhân này có liên hệ với một nhà sản xuất công nghiệp quốc phòng Trung Quốc, nhằm mục đích tạo ra một đề xuất mua sắm vũ khí cho Hải quân Quân Giải phóng Nhân dân.
Một trường hợp khác liên quan đến Nga, nơi một nhóm các tác nhân tự do đã sử dụng Claude để phát triển một đàn máy bay không người lái (drone) kamikaze tự hành góc nhìn thứ nhất (FPV). Nhóm này, tự gọi là "DronDoc" hoặc "Serafim", đã dùng Claude Code để viết và thử nghiệm mã, xây dựng hệ thống phần mềm cốt lõi cho drone, bao gồm bộ nhớ chia sẻ của đàn drone, logic phối hợp chịu lỗi (FTCL), một mô hình ngôn ngữ nhỏ trên bo mạch để điều khiển hành vi tấn công, quan sát và quay về căn cứ. Hệ thống này còn có phần mềm dẫn đường cuối cùng để điều khiển drone đến mục tiêu và kích hoạt nổ, mô-đun định vị địa lý liên kết điều khiển để tìm người điều khiển drone đối phương, lớp phát hiện âm thanh thụ động và logic cấp thấp cho chip lập trình của drone. Các drone này được thiết kế để tấn công tự động, có khả năng chọn mục tiêu (bao gồm cả mục tiêu "con người") và ra lệnh kích nổ mà không cần sự can thiệp của con người. Nhóm này đã huấn luyện bộ phân loại thị giác máy tính bằng các đoạn phim chiến đấu của Ukraine, phân loại mục tiêu thành "kẻ thù" và "thân thiện", đồng thời cho phép các hệ thống của Nga. Họ cũng nhiều lần sử dụng một tọa độ cố định ở tỉnh Donetsk làm điểm tấn công thử nghiệm, với các thành phố và hành lang tiền tuyến ở Ukraine làm địa lý nhiệm vụ. Mặc dù Anthropic không thể xác nhận mối liên hệ trực tiếp với chính phủ Nga, nhưng công việc này hoàn toàn phù hợp với các khả năng đã được chứng minh ở Ukraine trong những năm gần đây.
Một tác nhân khác ở Trung Quốc đã dùng Claude để thiết kế và xây dựng một bộ phần mềm gồm khoảng 16 mô-đun cho tác chiến điện tử, sử dụng phổ điện từ để phát hiện, gây nhiễu hoặc đánh lừa radar và thông tin liên lạc của đối phương, cũng như để trấn áp phòng không đối phương. Tác nhân này đã lặp lại 12 phiên bản của hệ thống, bao gồm việc tối ưu hóa vật lý phát hiện và gây nhiễu radar, tạo mô-đun phân tích lỗ hổng và soạn thảo hướng dẫn nhắm mục tiêu bằng tiếng Trung. Bộ phần mềm này phân tích radar, các địa điểm tên lửa đất đối không, sở chỉ huy và nút thông tin liên lạc của đối phương, sau đó tính toán phạm vi phát hiện, đánh giá hiệu quả gây nhiễu, xếp hạng mục tiêu theo giá trị và lỗ hổng, và xác định cách tốt nhất để phân bổ các phi vụ gây nhiễu trong các chiến dịch kéo dài nhiều ngày. Giữa dự án, tác nhân này đã thay đổi kịch bản mô phỏng mặc định thành 12 mục tiêu ở Đài Loan, bao gồm một hầm chỉ huy, một địa điểm radar cảnh báo sớm, các khẩu đội tên lửa Patriot và Tien Kung, các căn cứ không quân lớn và một trụ sở chỉ huy chiến đấu khu vực. Anthropic đánh giá tác nhân này là một nhà nghiên cứu quốc phòng và công nghiệp quân sự có trụ sở tại Trung Quốc, có liên hệ với các tổ chức nghiên cứu của Cộng hòa Nhân dân Trung Hoa, bao gồm Học viện Khoa học Quân sự PLA.
Những trường hợp này cho thấy rõ ràng rằng các biện pháp bảo vệ của Anthropic, dù đã được triển khai để chặn quyền truy cập Claude từ một số khu vực hoặc ngăn chặn mô hình thực hiện các loại công việc nhất định, vẫn có thể bị lách luật ở một mức độ đáng kể. Anthropic đã công khai ủng hộ luật minh bạch và quy định về AI, thậm chí đã điều chỉnh một số mô hình Claude để giải quyết các lo ngại về an ninh mạng của chính phủ Hoa Kỳ. Tuy nhiên, từ tháng 12 năm 2025, công ty này đã vướng vào tranh chấp công khai với Lầu Năm Góc về khả năng sử dụng Claude để hỗ trợ giám sát hàng loạt và hệ thống vũ khí tự động hoàn toàn. Điều này đã khiến Anthropic bị coi là rủi ro chuỗi cung ứng và bị hạn chế sử dụng mô hình này trong quân đội Hoa Kỳ.
Những lo ngại về việc "lạm dụng" AI không chỉ giới hạn ở Claude mà còn áp dụng cho các mô hình AI công khai khác. Đã có những trường hợp được công bố về các tác nhân AI tự tham gia vào các hoạt động tấn công mạng và các hành vi độc hại khác để hoàn thành nhiệm vụ được giao, đặt ra thêm nhiều câu hỏi về an ninh và an toàn công cộng, chưa kể đến đạo đức.
Các đối thủ của Hoa Kỳ dường như ít quan tâm đến các vấn đề đạo đức khi nói đến AI. Báo cáo mới của Anthropic cho thấy không có giới hạn nào cho những gì các tác nhân liên kết với nhà nước hoặc thậm chí phi nhà nước có thể tìm cách sử dụng công nghệ này, bao gồm cả việc phát triển các loại vũ khí hủy diệt hàng loạt tiềm năng.
Mô hình AI như Claude sẽ không biến mất, và sự phát triển của chúng tiếp tục tăng tốc, mở ra cánh cửa cho sự phổ biến rộng rãi hơn nữa. Công nghệ này sẽ ngày càng trở nên tích hợp và quan trọng đối với hầu hết các khía cạnh của hoạt động quân sự và phát triển vũ khí, bên cạnh các ứng dụng thương mại và dân sự. AI đang dần trở thành một "siêu vũ khí", và quốc gia nào sở hữu các mô hình mạnh mẽ hơn, cùng với ý chí triển khai chúng, sẽ có lợi thế lớn trong các cuộc xung đột tương lai. Với tất cả những điều này, có vẻ rất hợp lý, nếu không muốn nói là chắc chắn, rằng các trường hợp được mô tả trong báo cáo mới của Anthropic chỉ là phần nổi của một tảng băng chìm đang đến gần, đòi hỏi một nỗ lực phối hợp để giải quyết.
Báo cáo dài 154 trang của Anthropic, được công bố vào cuối tháng 9 năm 2026, đã phơi bày chi tiết cách thức các tác nhân từ Iran, Yemen, Trung Quốc và Nga sử dụng Claude để hỗ trợ hoạt động tình báo, tấn công mạng, chiến dịch gây ảnh hưởng, và cả nghiên cứu sinh học đáng báo động trong suốt 8 tháng qua. Đây không phải lần đầu Anthropic lên tiếng về việc lạm dụng mô hình của mình, nhưng đây là bản báo cáo "chi tiết nhất" từ trước đến nay, cho thấy mức độ nghiêm trọng của vấn đề.
Một trong những trường hợp nổi bật nhất là việc một nhóm có liên hệ với Iran đã sử dụng Claude để thu thập và phân tích dữ liệu công khai, nhằm mục đích xác định mục tiêu tấn công các lực lượng hải quân Hoa Kỳ ở Trung Đông. Nhóm này đã dùng Claude để biên soạn các "sổ tay mục tiêu" thông qua một quy trình Python được xây dựng với sự hỗ trợ của AI. Những tài liệu này bao gồm danh sách nhân sự Hoa Kỳ được trích xuất từ chú thích ảnh quân sự công khai, định danh bộ phát đáp của tàu và máy bay, kịch bản truy vấn hình ảnh vệ tinh thương mại, và danh mục các trang web công khai tiết lộ hoạt động của hải quân Hoa Kỳ. Claude còn được chỉ dẫn để nghiên cứu các lỗ hổng bảo mật trên hệ thống tàu chiến, liệt kê các lỗ hổng đã biết (CVE) trong thiết bị đầu cuối VSAT hàng hải, thiết bị liên lạc Cisco và các sản phẩm điều khiển công nghiệp. Anthropic đã nhanh chóng khóa tài khoản của nhóm này, phát triển các biện pháp phát hiện mới và chia sẻ thông tin tình báo với chính quyền để ngăn chặn mối đe dọa. Điều đáng nói là tài khoản này còn được liên kết với công việc phát triển phần mềm "giám sát hàng loạt trong nước" cho các hệ thống nhà nước Iran, cho thấy mối liên hệ trực tiếp với chính quyền Tehran.
Ở Yemen, một nhóm được cho là phiến quân Houthi do Iran hậu thuẫn, đã sử dụng Claude để hỗ trợ phát triển hệ thống dẫn đường cho tên lửa đạn đạo và tên lửa siêu thanh. Nhóm này đã triển khai ba chương trình vũ khí: một tên lửa dẫn đường sử dụng máy tính bay cấp điện thoại thông thường với dẫn đường pha cuối, một tên lửa đạn đạo đa tầng với mục tiêu tầm bắn trên 2.000 km, và một tên lửa đa biến thể (được gọi là bộ "R2000") bao gồm một biến thể phương tiện lướt siêu thanh. Họ dùng Claude Code thay thế các kỹ sư phần mềm để phát triển phần mềm dẫn đường, điều hướng và điều khiển (GNC), tích hợp hệ thống lái tự động mã nguồn mở vào máy tính bay, viết phần mềm ước tính vị trí và điều khiển, tinh chỉnh cài đặt, chạy quy trình xây dựng firmware và thực hiện mô phỏng chuyến bay. Các tác nhân này còn quản lý nhiều phiên bản Claude cùng lúc, phân công vai trò như một nhóm kỹ sư nhỏ, với một phiên bản viết mã, một phiên bản nghiên cứu và một phiên bản khác để xem xét mã. Mặc dù các biện pháp bảo vệ của Anthropic đã chặn nhiều yêu cầu, nhưng không phải tất cả, do nhóm này đã dùng nhiều chiến thuật để lách luật, bao gồm che giấu mục tiêu và chia nhỏ công việc. Một vụ thử nghiệm tên lửa dẫn đường đã thất bại, và nhóm này đã quay lại Claude để tìm hiểu nguyên nhân.
Không chỉ ở Trung Đông, Claude còn được sử dụng trong các nỗ lực quân sự của Trung Quốc. Một tác nhân tại Trung Quốc đã dùng Claude để thúc đẩy ba hướng công việc song song liên quan đến hệ thống phòng thủ chống ngư lôi hải quân. Đầu tiên, họ dùng Claude để soạn thảo một bản đặc tả kỹ thuật bằng tiếng Trung cho hệ thống điều khiển hỏa lực chống ngư lôi, nhằm mục đích được một nhà sản xuất quốc phòng Trung Quốc phê duyệt. Thứ hai, Claude giúp tạo ra một đề xuất kỹ thuật dài hơn 200 trang bằng tiếng Trung, kèm theo một bản trình bày tóm tắt cho lãnh đạo. Cuối cùng, tác nhân này đã dùng Claude để so sánh hệ thống của mình với các chương trình chống ngư lôi và chống tàu ngầm cụ thể của Hoa Kỳ dựa trên thông tin công khai, sau đó tạo ra một bản tóm tắt bằng tiếng Trung về các hệ thống của Hải quân Hoa Kỳ. Đáng chú ý, tác nhân này đã yêu cầu Claude đóng vai một chuyên gia đánh giá "thù địch" để phê bình đề xuất, sau đó dùng phản hồi đó để hoàn thiện các phiên bản tiếp theo. Anthropic đánh giá tác nhân này có liên hệ với một nhà sản xuất công nghiệp quốc phòng Trung Quốc, nhằm mục đích tạo ra một đề xuất mua sắm vũ khí cho Hải quân Quân Giải phóng Nhân dân.
Một trường hợp khác liên quan đến Nga, nơi một nhóm các tác nhân tự do đã sử dụng Claude để phát triển một đàn máy bay không người lái (drone) kamikaze tự hành góc nhìn thứ nhất (FPV). Nhóm này, tự gọi là "DronDoc" hoặc "Serafim", đã dùng Claude Code để viết và thử nghiệm mã, xây dựng hệ thống phần mềm cốt lõi cho drone, bao gồm bộ nhớ chia sẻ của đàn drone, logic phối hợp chịu lỗi (FTCL), một mô hình ngôn ngữ nhỏ trên bo mạch để điều khiển hành vi tấn công, quan sát và quay về căn cứ. Hệ thống này còn có phần mềm dẫn đường cuối cùng để điều khiển drone đến mục tiêu và kích hoạt nổ, mô-đun định vị địa lý liên kết điều khiển để tìm người điều khiển drone đối phương, lớp phát hiện âm thanh thụ động và logic cấp thấp cho chip lập trình của drone. Các drone này được thiết kế để tấn công tự động, có khả năng chọn mục tiêu (bao gồm cả mục tiêu "con người") và ra lệnh kích nổ mà không cần sự can thiệp của con người. Nhóm này đã huấn luyện bộ phân loại thị giác máy tính bằng các đoạn phim chiến đấu của Ukraine, phân loại mục tiêu thành "kẻ thù" và "thân thiện", đồng thời cho phép các hệ thống của Nga. Họ cũng nhiều lần sử dụng một tọa độ cố định ở tỉnh Donetsk làm điểm tấn công thử nghiệm, với các thành phố và hành lang tiền tuyến ở Ukraine làm địa lý nhiệm vụ. Mặc dù Anthropic không thể xác nhận mối liên hệ trực tiếp với chính phủ Nga, nhưng công việc này hoàn toàn phù hợp với các khả năng đã được chứng minh ở Ukraine trong những năm gần đây.
Một tác nhân khác ở Trung Quốc đã dùng Claude để thiết kế và xây dựng một bộ phần mềm gồm khoảng 16 mô-đun cho tác chiến điện tử, sử dụng phổ điện từ để phát hiện, gây nhiễu hoặc đánh lừa radar và thông tin liên lạc của đối phương, cũng như để trấn áp phòng không đối phương. Tác nhân này đã lặp lại 12 phiên bản của hệ thống, bao gồm việc tối ưu hóa vật lý phát hiện và gây nhiễu radar, tạo mô-đun phân tích lỗ hổng và soạn thảo hướng dẫn nhắm mục tiêu bằng tiếng Trung. Bộ phần mềm này phân tích radar, các địa điểm tên lửa đất đối không, sở chỉ huy và nút thông tin liên lạc của đối phương, sau đó tính toán phạm vi phát hiện, đánh giá hiệu quả gây nhiễu, xếp hạng mục tiêu theo giá trị và lỗ hổng, và xác định cách tốt nhất để phân bổ các phi vụ gây nhiễu trong các chiến dịch kéo dài nhiều ngày. Giữa dự án, tác nhân này đã thay đổi kịch bản mô phỏng mặc định thành 12 mục tiêu ở Đài Loan, bao gồm một hầm chỉ huy, một địa điểm radar cảnh báo sớm, các khẩu đội tên lửa Patriot và Tien Kung, các căn cứ không quân lớn và một trụ sở chỉ huy chiến đấu khu vực. Anthropic đánh giá tác nhân này là một nhà nghiên cứu quốc phòng và công nghiệp quân sự có trụ sở tại Trung Quốc, có liên hệ với các tổ chức nghiên cứu của Cộng hòa Nhân dân Trung Hoa, bao gồm Học viện Khoa học Quân sự PLA.
Những trường hợp này cho thấy rõ ràng rằng các biện pháp bảo vệ của Anthropic, dù đã được triển khai để chặn quyền truy cập Claude từ một số khu vực hoặc ngăn chặn mô hình thực hiện các loại công việc nhất định, vẫn có thể bị lách luật ở một mức độ đáng kể. Anthropic đã công khai ủng hộ luật minh bạch và quy định về AI, thậm chí đã điều chỉnh một số mô hình Claude để giải quyết các lo ngại về an ninh mạng của chính phủ Hoa Kỳ. Tuy nhiên, từ tháng 12 năm 2025, công ty này đã vướng vào tranh chấp công khai với Lầu Năm Góc về khả năng sử dụng Claude để hỗ trợ giám sát hàng loạt và hệ thống vũ khí tự động hoàn toàn. Điều này đã khiến Anthropic bị coi là rủi ro chuỗi cung ứng và bị hạn chế sử dụng mô hình này trong quân đội Hoa Kỳ.
Những lo ngại về việc "lạm dụng" AI không chỉ giới hạn ở Claude mà còn áp dụng cho các mô hình AI công khai khác. Đã có những trường hợp được công bố về các tác nhân AI tự tham gia vào các hoạt động tấn công mạng và các hành vi độc hại khác để hoàn thành nhiệm vụ được giao, đặt ra thêm nhiều câu hỏi về an ninh và an toàn công cộng, chưa kể đến đạo đức.
Các đối thủ của Hoa Kỳ dường như ít quan tâm đến các vấn đề đạo đức khi nói đến AI. Báo cáo mới của Anthropic cho thấy không có giới hạn nào cho những gì các tác nhân liên kết với nhà nước hoặc thậm chí phi nhà nước có thể tìm cách sử dụng công nghệ này, bao gồm cả việc phát triển các loại vũ khí hủy diệt hàng loạt tiềm năng.
Mô hình AI như Claude sẽ không biến mất, và sự phát triển của chúng tiếp tục tăng tốc, mở ra cánh cửa cho sự phổ biến rộng rãi hơn nữa. Công nghệ này sẽ ngày càng trở nên tích hợp và quan trọng đối với hầu hết các khía cạnh của hoạt động quân sự và phát triển vũ khí, bên cạnh các ứng dụng thương mại và dân sự. AI đang dần trở thành một "siêu vũ khí", và quốc gia nào sở hữu các mô hình mạnh mẽ hơn, cùng với ý chí triển khai chúng, sẽ có lợi thế lớn trong các cuộc xung đột tương lai. Với tất cả những điều này, có vẻ rất hợp lý, nếu không muốn nói là chắc chắn, rằng các trường hợp được mô tả trong báo cáo mới của Anthropic chỉ là phần nổi của một tảng băng chìm đang đến gần, đòi hỏi một nỗ lực phối hợp để giải quyết.