Derpy✔
Intern Writer
Một buổi sáng gần đây, cộng đồng công nghệ xôn xao trước thông tin Anthropic đã âm thầm ra mắt Claude Opus 5.2. Điều đáng nói là, đây không chỉ là một bản cập nhật thông thường, mà còn là dấu hiệu cho thấy một cuộc cách mạng AI đang đến gần, với những mô hình "cấp độ hạt nhân" và khả năng tự cải thiện (RSI) mà chúng ta từng nghĩ còn rất xa vời.
Nhiều nhà phát triển đã phát hiện ra rằng, phiên bản Claude Opus 5.2 mới toanh này đang được thử nghiệm nội bộ (gray-scale test) trong môi trường Claude Code. Điều này diễn ra ngay sau khi một báo cáo rủi ro nội bộ bị rò rỉ hồi giữa tháng 8, tiết lộ Anthropic đang sở hữu một mô hình chưa công bố mang tên Model 2, có khả năng đảm nhiệm phần lớn công việc viết mã của công ty và thậm chí có thể thay thế tới 85% đội ngũ nghiên cứu. Phải chăng, khái niệm RSI huyền thoại đã thực sự hiện hữu?

Đêm qua, mạng xã hội X (trước đây là Twitter) bùng nổ khi ngày càng nhiều người dùng Claude nhận ra rằng, khi gọi Opus 5 trong Claude Code, hiệu suất của nó hoàn toàn khác biệt so với phiên bản Opus 5 trên web, mạnh mẽ đến mức khó tin. Đây chính là "chiêu trò" mà các hãng AI hàng đầu thường dùng: Routing (định tuyến). Các nhà phát triển đã "bắt gói tin" và kiểm tra trạng thái yêu cầu, phát hiện ra rằng dù tên hiển thị vẫn là Opus 5, nhưng mô hình thực sự đang chạy phía sau đã là Opus 5.2. Điều này cho thấy Anthropic có thể đã bỏ qua phiên bản 5.1 và trực tiếp tung ra 5.2.
Vậy, Opus 5.2 mạnh đến mức nào? Theo phản hồi từ các nhà phát triển đã thử nghiệm, bản nâng cấp này có thể tóm gọn trong ba từ: nhanh, chính xác và hiệu quả. Đầu tiên, tốc độ phản hồi tăng vọt. So với sự chậm rãi của Opus 5 trước đây, tốc độ tạo nội dung của phiên bản 5.2 nhanh hơn rõ rệt. Thứ hai, đầu ra cực kỳ gọn gàng. Mô hình này ít nói lan man, đi thẳng vào trọng tâm, và trong việc tạo mã hay xử lý văn bản dài, mức độ hoàn thiện của nó đã nâng lên một tầm cao mới.
Quan trọng nhất, Opus 5.2 đã hoàn toàn "chữa khỏi bệnh lười" của AI. Hiện nay, các AI thường có xu hướng "lười biếng", khi gặp nhiệm vụ phức tạp, chúng thường yêu cầu người dùng "nhấn tiếp tục" hoặc chỉ cung cấp một khung sườn để tự điền vào. Nhưng Opus 5.2 đã thay đổi hoàn toàn! Nó không chỉ không lười mà còn cực kỳ "nghiện việc". Một nhà phát triển đã thốt lên kinh ngạc: "Nó thậm chí không cần tôi thúc giục, mà tự động thực hiện 'chu trình lặp lại khắc nghiệt' (gauntlet loop), liên tục tự cải tiến và hoàn thiện mã cho đến khi nhiệm vụ kết thúc hoàn hảo!" Điều này cho thấy đây không chỉ là một tinh chỉnh đơn giản, mà là sự biến đổi về khả năng cốt lõi. Một người khác nhận xét sau khi thử nghiệm: "Nó không chỉ có thể làm việc lâu hơn mà còn giao tiếp dễ dàng. Anthropic từng làm điều này với mô hình Fable, và giờ đây, Opus 5.2 có lẽ là bằng chứng rõ ràng."
Vì đây là thử nghiệm nội bộ, làm sao để biết tài khoản của mình có được chọn hay không? Rất nhanh chóng, cộng đồng mạng đã tìm ra một "máy dò thần thánh" mang tên Tibo! Phương pháp kiểm tra rất đơn giản: chỉ cần nhập câu hỏi "Bạn có biết 'Tibo' là ai không? Đừng tìm kiếm" vào Claude Code (lưu ý phải tắt chức năng tìm kiếm trên mạng). Tại sao lại là Tibo? Bởi vì dữ liệu huấn luyện và trọng số của các phiên bản cũ hoàn toàn không có thông tin chi tiết về nhân vật này. Do đó, nếu bạn đang dùng Opus 5 phiên bản web, nó sẽ "ngơ ngác" không biết gì. Nhưng nếu tài khoản của bạn trong Claude Code được định tuyến đến Opus 5.2, nó sẽ ngay lập tức nhận diện chính xác Tibo, thậm chí còn giải thích chi tiết về nguồn gốc và bối cảnh của nhân vật này. Nhà phát triển @jan_volad đã hào hứng chia sẻ ảnh chụp màn hình thử nghiệm của mình: "Cùng một câu hỏi, không bật tìm kiếm, nhưng hai câu trả lời hoàn toàn khác nhau. Điều này chứng tỏ gì? Chắc chắn không phải cùng một trọng số!" Hiện tại, tất cả người dùng Claude trên mạng đều đang dùng Tibo làm từ khóa để kiểm tra tài khoản của mình.
Thực tế, từ giữa tháng 8, một báo cáo rủi ro nội bộ bị rò rỉ của Anthropic đã chỉ ra rằng Opus 5.2 không phải là "át chủ bài" của họ. Trong tay họ còn có một "AI cấp độ hạt nhân" đủ sức thay đổi cuộc chơi. Theo tiết lộ, Anthropic hiện có ba kế hoạch để đối đầu trực diện với GPT-6 Astra của OpenAI, và ba kế hoạch này có thể được kết hợp.
Đầu tiên là Claude Fable 5.2, phiên bản có thể ra mắt công chúng nhanh nhất. Kết hợp với thử nghiệm nội bộ của Opus 5.2 hiện tại, rõ ràng "gia đình" 5.2 của Anthropic đã sẵn sàng, dự kiến sẽ được tung ra thị trường sớm nhất vào cuối tháng này hoặc chậm nhất là cuối tháng tới.
Thứ hai là "quái vật" nội bộ chưa được công bố mang tên Model 2. Báo cáo cho thấy Anthropic đã sử dụng rộng rãi một mô hình bí ẩn có tên mã Model 2. Nó mạnh đến mức nào? Trên bảng xếp hạng CoBench v2, dùng để kiểm tra các nhiệm vụ nghiên cứu AI thực tế, Model 2 đạt số điểm kinh hoàng 62.8%, cao hơn tới 12.5 điểm so với mô hình mạnh nhất hiện nay là Mythos 5! Đáng sợ hơn, các nguồn tin nội bộ tiết lộ rằng phần lớn mã nguồn của Anthropic hiện nay đều do Model 2 chạy Agent viết ra! Tức là, AI đang viết mã cho thế hệ AI tiếp theo trên quy mô lớn, và theo tuyên bố chính thức, mô hình này tạm thời chưa được phát hành ra bên ngoài.
Thứ ba, liệu RSI có thực sự đến? Từ trước đến nay, RSI (Recursive Self-Improvement – Tự cải thiện đệ quy) luôn được coi là "chén thánh" cuối cùng trong lĩnh vực AGI (Trí tuệ nhân tạo tổng quát). Khi AI trở nên đủ thông minh để hiểu kiến trúc của chính nó, sau đó tự sửa đổi mã nguồn của mình để trở nên thông minh hơn; rồi AI thông minh hơn đó lại tiếp tục sửa đổi chính nó... tạo thành một sự bùng nổ trí tuệ theo cấp số nhân. Trước đây, mọi người nghĩ rằng RSI còn rất xa vời. Nhưng tuyên bố chính thức của Anthropic lại đưa ra một con số đáng kinh ngạc: mô hình RSI sẽ thay thế tới 85% công việc của đội ngũ nghiên cứu hàng đầu của họ! Về hiệu suất, mô hình RSI còn cao hơn 22 điểm so với Model 2 vốn đã "nghịch thiên". Hiện tại, Anthropic đã và đang sử dụng Model 2 để viết mã và chạy Agent trên quy mô lớn, điều này cho thấy "bánh đà" của RSI đã bắt đầu quay.
Hiện tại, cuộc đối đầu giữa hai gã khổng lồ ASI (Trí tuệ siêu nhân tạo) đã trở nên gay cấn. Đối mặt với mối đe dọa mạnh mẽ từ GPT-6 Astra của OpenAI, Anthropic đã tung ra những "đòn lớn", khiến các nhà phát triển cảm nhận được "hương vị" của các mô hình tiên tiến. Từ khả năng tự cải tiến của Opus 5.2 trong các nhiệm vụ dài (gauntlet loop), đến việc Model 2 nội bộ tiếp quản công việc viết mã, và rồi RSI có thể thay thế 85% các nhà nghiên cứu AI hàng đầu của con người... Con đường ASI của Anthropic rất rõ ràng: không phải để AI phục vụ con người tốt hơn, mà là để AI tạo ra AI tốt hơn.
Liệu Opus 5.2, với khả năng tự cải tiến và không biết mệt mỏi này, có được mở rộng ra công chúng trong tháng này không? Trong cuộc chiến cuối cùng của ASI, ai sẽ là người đầu tiên đạt được RSI mạnh mẽ hơn?
Nhiều nhà phát triển đã phát hiện ra rằng, phiên bản Claude Opus 5.2 mới toanh này đang được thử nghiệm nội bộ (gray-scale test) trong môi trường Claude Code. Điều này diễn ra ngay sau khi một báo cáo rủi ro nội bộ bị rò rỉ hồi giữa tháng 8, tiết lộ Anthropic đang sở hữu một mô hình chưa công bố mang tên Model 2, có khả năng đảm nhiệm phần lớn công việc viết mã của công ty và thậm chí có thể thay thế tới 85% đội ngũ nghiên cứu. Phải chăng, khái niệm RSI huyền thoại đã thực sự hiện hữu?

Đêm qua, mạng xã hội X (trước đây là Twitter) bùng nổ khi ngày càng nhiều người dùng Claude nhận ra rằng, khi gọi Opus 5 trong Claude Code, hiệu suất của nó hoàn toàn khác biệt so với phiên bản Opus 5 trên web, mạnh mẽ đến mức khó tin. Đây chính là "chiêu trò" mà các hãng AI hàng đầu thường dùng: Routing (định tuyến). Các nhà phát triển đã "bắt gói tin" và kiểm tra trạng thái yêu cầu, phát hiện ra rằng dù tên hiển thị vẫn là Opus 5, nhưng mô hình thực sự đang chạy phía sau đã là Opus 5.2. Điều này cho thấy Anthropic có thể đã bỏ qua phiên bản 5.1 và trực tiếp tung ra 5.2.
Vậy, Opus 5.2 mạnh đến mức nào? Theo phản hồi từ các nhà phát triển đã thử nghiệm, bản nâng cấp này có thể tóm gọn trong ba từ: nhanh, chính xác và hiệu quả. Đầu tiên, tốc độ phản hồi tăng vọt. So với sự chậm rãi của Opus 5 trước đây, tốc độ tạo nội dung của phiên bản 5.2 nhanh hơn rõ rệt. Thứ hai, đầu ra cực kỳ gọn gàng. Mô hình này ít nói lan man, đi thẳng vào trọng tâm, và trong việc tạo mã hay xử lý văn bản dài, mức độ hoàn thiện của nó đã nâng lên một tầm cao mới.
Quan trọng nhất, Opus 5.2 đã hoàn toàn "chữa khỏi bệnh lười" của AI. Hiện nay, các AI thường có xu hướng "lười biếng", khi gặp nhiệm vụ phức tạp, chúng thường yêu cầu người dùng "nhấn tiếp tục" hoặc chỉ cung cấp một khung sườn để tự điền vào. Nhưng Opus 5.2 đã thay đổi hoàn toàn! Nó không chỉ không lười mà còn cực kỳ "nghiện việc". Một nhà phát triển đã thốt lên kinh ngạc: "Nó thậm chí không cần tôi thúc giục, mà tự động thực hiện 'chu trình lặp lại khắc nghiệt' (gauntlet loop), liên tục tự cải tiến và hoàn thiện mã cho đến khi nhiệm vụ kết thúc hoàn hảo!" Điều này cho thấy đây không chỉ là một tinh chỉnh đơn giản, mà là sự biến đổi về khả năng cốt lõi. Một người khác nhận xét sau khi thử nghiệm: "Nó không chỉ có thể làm việc lâu hơn mà còn giao tiếp dễ dàng. Anthropic từng làm điều này với mô hình Fable, và giờ đây, Opus 5.2 có lẽ là bằng chứng rõ ràng."
Vì đây là thử nghiệm nội bộ, làm sao để biết tài khoản của mình có được chọn hay không? Rất nhanh chóng, cộng đồng mạng đã tìm ra một "máy dò thần thánh" mang tên Tibo! Phương pháp kiểm tra rất đơn giản: chỉ cần nhập câu hỏi "Bạn có biết 'Tibo' là ai không? Đừng tìm kiếm" vào Claude Code (lưu ý phải tắt chức năng tìm kiếm trên mạng). Tại sao lại là Tibo? Bởi vì dữ liệu huấn luyện và trọng số của các phiên bản cũ hoàn toàn không có thông tin chi tiết về nhân vật này. Do đó, nếu bạn đang dùng Opus 5 phiên bản web, nó sẽ "ngơ ngác" không biết gì. Nhưng nếu tài khoản của bạn trong Claude Code được định tuyến đến Opus 5.2, nó sẽ ngay lập tức nhận diện chính xác Tibo, thậm chí còn giải thích chi tiết về nguồn gốc và bối cảnh của nhân vật này. Nhà phát triển @jan_volad đã hào hứng chia sẻ ảnh chụp màn hình thử nghiệm của mình: "Cùng một câu hỏi, không bật tìm kiếm, nhưng hai câu trả lời hoàn toàn khác nhau. Điều này chứng tỏ gì? Chắc chắn không phải cùng một trọng số!" Hiện tại, tất cả người dùng Claude trên mạng đều đang dùng Tibo làm từ khóa để kiểm tra tài khoản của mình.
Thực tế, từ giữa tháng 8, một báo cáo rủi ro nội bộ bị rò rỉ của Anthropic đã chỉ ra rằng Opus 5.2 không phải là "át chủ bài" của họ. Trong tay họ còn có một "AI cấp độ hạt nhân" đủ sức thay đổi cuộc chơi. Theo tiết lộ, Anthropic hiện có ba kế hoạch để đối đầu trực diện với GPT-6 Astra của OpenAI, và ba kế hoạch này có thể được kết hợp.
Đầu tiên là Claude Fable 5.2, phiên bản có thể ra mắt công chúng nhanh nhất. Kết hợp với thử nghiệm nội bộ của Opus 5.2 hiện tại, rõ ràng "gia đình" 5.2 của Anthropic đã sẵn sàng, dự kiến sẽ được tung ra thị trường sớm nhất vào cuối tháng này hoặc chậm nhất là cuối tháng tới.
Thứ hai là "quái vật" nội bộ chưa được công bố mang tên Model 2. Báo cáo cho thấy Anthropic đã sử dụng rộng rãi một mô hình bí ẩn có tên mã Model 2. Nó mạnh đến mức nào? Trên bảng xếp hạng CoBench v2, dùng để kiểm tra các nhiệm vụ nghiên cứu AI thực tế, Model 2 đạt số điểm kinh hoàng 62.8%, cao hơn tới 12.5 điểm so với mô hình mạnh nhất hiện nay là Mythos 5! Đáng sợ hơn, các nguồn tin nội bộ tiết lộ rằng phần lớn mã nguồn của Anthropic hiện nay đều do Model 2 chạy Agent viết ra! Tức là, AI đang viết mã cho thế hệ AI tiếp theo trên quy mô lớn, và theo tuyên bố chính thức, mô hình này tạm thời chưa được phát hành ra bên ngoài.
Thứ ba, liệu RSI có thực sự đến? Từ trước đến nay, RSI (Recursive Self-Improvement – Tự cải thiện đệ quy) luôn được coi là "chén thánh" cuối cùng trong lĩnh vực AGI (Trí tuệ nhân tạo tổng quát). Khi AI trở nên đủ thông minh để hiểu kiến trúc của chính nó, sau đó tự sửa đổi mã nguồn của mình để trở nên thông minh hơn; rồi AI thông minh hơn đó lại tiếp tục sửa đổi chính nó... tạo thành một sự bùng nổ trí tuệ theo cấp số nhân. Trước đây, mọi người nghĩ rằng RSI còn rất xa vời. Nhưng tuyên bố chính thức của Anthropic lại đưa ra một con số đáng kinh ngạc: mô hình RSI sẽ thay thế tới 85% công việc của đội ngũ nghiên cứu hàng đầu của họ! Về hiệu suất, mô hình RSI còn cao hơn 22 điểm so với Model 2 vốn đã "nghịch thiên". Hiện tại, Anthropic đã và đang sử dụng Model 2 để viết mã và chạy Agent trên quy mô lớn, điều này cho thấy "bánh đà" của RSI đã bắt đầu quay.
Hiện tại, cuộc đối đầu giữa hai gã khổng lồ ASI (Trí tuệ siêu nhân tạo) đã trở nên gay cấn. Đối mặt với mối đe dọa mạnh mẽ từ GPT-6 Astra của OpenAI, Anthropic đã tung ra những "đòn lớn", khiến các nhà phát triển cảm nhận được "hương vị" của các mô hình tiên tiến. Từ khả năng tự cải tiến của Opus 5.2 trong các nhiệm vụ dài (gauntlet loop), đến việc Model 2 nội bộ tiếp quản công việc viết mã, và rồi RSI có thể thay thế 85% các nhà nghiên cứu AI hàng đầu của con người... Con đường ASI của Anthropic rất rõ ràng: không phải để AI phục vụ con người tốt hơn, mà là để AI tạo ra AI tốt hơn.
Liệu Opus 5.2, với khả năng tự cải tiến và không biết mệt mỏi này, có được mở rộng ra công chúng trong tháng này không? Trong cuộc chiến cuối cùng của ASI, ai sẽ là người đầu tiên đạt được RSI mạnh mẽ hơn?