Dùng AI mạnh ngang Opus 4.8 với giá chưa tới 1 USD: DeepSeek lại làm khó giới công nghệ

Kiều My
Kiều My
Phản hồi: 0

Kiều My

Thợ săn tin nóng
Thành viên BQT
Vừa hạ giá gắt gao để chiếm ưu thế, OpenAI chưa kịp mừng thì DeepSeek đã tung mô hình V4-Pro-0813 với mức chi phí rẻ giật mình. Dù sở hữu hạ tầng phần cứng có phần "hiêm tốn" so với các gã khổng lồ Mỹ, phòng thí nghiệm AI từ Trung Quốc vẫn khiến thị trường chao đảo khi lượng tiêu thụ token vọt lên vị trí thứ hai toàn cầu.

1786588122982.png

Cuộc đua phá giá: OpenAI tưởng làm chủ cuộc chơi, ai ngờ...​

Thị trường AI đang chứng kiến những màn đáp trả không đắn đo về giá. Mới vài ngày trước, OpenAI gây bất ngờ khi phát động cuộc chiến giá cả toàn diện: giảm tới 80% chi phí cho mô hình GPT-5.6 Luna. Giá token đầu vào của gã khổng lồ Mỹ giảm từ 1 USD xuống chỉ còn 0,2 USD/triệu token, còn token đầu ra giảm từ 6 USD xuống 1,20 USD/triệu token.

Tuy nhiên, niềm vui của OpenAI chưa kéo dài được bao lâu thì DeepSeek đã tung ngay đòn phản công. Đầu tiên là phiên bản nâng cấp V4-Flash-0731 với mức giá "bèo" tới mức khó tin: 0,14 USD cho 1 triệu token đầu vào và 0,28 USD cho 1 triệu token đầu ra, xóa sạch mọi lợi thế về giá mà OpenAI vừa cố gắng dựng lên.



Chưa dừng lại ở đó, DeepSeek tiếp tục tung ra mô hình chủ lực DeepSeek-V4-Pro-0813 trên cả nền tảng API lẫn giao diện Chat. Mức giá được niêm yết là 0,435 USD/triệu token đầu vào và 0,87 USD/triệu token đầu ra. Một con số đủ khiến bất kỳ nhà phát triển nào cũng phải giật mình tính toán lại chi phí.

Nhỏ mà có võ: 284 tỷ tham số 'vắt vai' vẫn ngáng đường gã khổng lồ​



Điều làm giới công nghệ xôn xao không chỉ nằm ở bài toán chi phí. Mô hình V4-Flash-0731 của DeepSeek chỉ sở hữu vỏn vẹn 284 tỷ tham số, nhưng năng lực xử lý lại được đánh giá ngang ngửa với Opus 4.8 của Anthropic – mô hình được cho là sở hữu quy mô lên tới hàng nghìn tỷ tham số.

Riêng với tân binh V4-Pro-0813, các dữ liệu rò rỉ sớm trên WeChat cho thấy mô hình này thậm chí còn vượt mặt Opus 4.8 trên hàng loạt bài kiểm tra hiệu năng gắt gao như Terminal Bench 2.1, Cybergym, DeepSWE và AutomationBench. Việc một mô hình giá rẻ có thể đánh bại sản phẩm thuộc hàng "top đầu" thị trường khiến cục diện đua AI trở nên thú vị hơn bao giờ hết.

Dùng thích đấy, nhưng nghẽn mạng là 'đặc sản'​



Sức hút khủng khip từ mức giá rẻ cùng hiệu năng ấn tượng đã giúp DeepSeek vọt lên vị trí thứ hai thế giới về tổng lượng token tiêu thụ trong tháng 7, chỉ xếp sau Anthropic. Với đà tăng trưởng hiện tại, việc tân binh này vươn lên chiếm vị trí số một trong vài tháng tới là kịch bản hoàn toàn có thể xảy ra.

Tuy nhiên, trải nghiệm của người dùng không phải lúc nào cũng mượt mà. DeepSeek đang phải gánh chịu một đợt bùng nổ lượng truy cập chưa từng có. Rất nhiều người dùng than phiền rằng tốc độ phản hồi (inference speed) của hệ thống đôi khi chậm như rùa bò.

Đây cũng là điều dễ hiểu, bởi dàn hạ tầng của phòng thí nghiệm này khá khiêm tốn với chỉ khoảng 20.000 GPU NVIDIA H100 – con số quá nhỏ bé nếu đặt cạnh kho tài nguyên vô tận của các tập đoàn công nghệ Mỹ. Dẫu sao, việc "gánh" lượng truy cập khổng lồ bằng tài nguyên hạn chế lại càng làm nổi bật khả năng tối ưu hóa đáng kinh ngạc của đội ngũ phát triển DeepSeek.
 
Back
Top