Mẫn Nhi
Admin xinh gái
Kỳ vọng nhiều nhưng thể hiện chẳng bao nhiêu, Gemini 3.6 Flash của Google vừa ra mắt đã vấp phải nhiều phản hồi tiêu cực khi điểm hiệu năng thực tế bị hàng loạt đối thủ vượt mặt.
Google chào sân Gemini 3.6 Flash với cửa sổ ngữ cảnh lên tới 1 triệu token, tương đương khoảng 1.500 trang văn bản A4, 30.000 dòng mã hoặc 1 giờ video. Mô hình hỗ trợ đa dạng dữ liệu đầu vào từ văn bản, hình ảnh, giọng nói đến video, với mức giá 7,5 USD cho mỗi triệu token đầu ra. Google cũng cho biết mô hình mới này tiêu thụ ít hơn 17% token đầu ra trong các quy trình làm việc nhiều bước.
Tuy nhiên, thời điểm xuất hiện của Gemini 3.6 Flash lại không mấy thuận lợi. Thị trường đang chứng kiến sự trỗi dậy mạnh mẽ từ các mô hình AI mã nguồn mở đến từ Trung Quốc, điển hình như Kimi K3 của Moonshot, vốn đang chiếm ưu thế nhờ các cải tiến kiến trúc giúp tối ưu chi phí mà vẫn giữ hiệu suất rất cao.
Điều khiến cộng đồng thất vọng nhất chính là khả năng thực chiến. Trong Báo cáo Chỉ số AI (AI Index), Gemini 3.6 Flash chỉ đạt 50 điểm, ngậm ngùi xếp sau một loạt tên tuổi như Meta Spark 1.1, GLM-5.2, GPT-5.6 Luna, Sonnet 5, Grok 4.5 và GPT-5.6 Terra.
Khi đi sâu vào từng bài kiểm tra cụ thể, Gemini 3.6 Flash thường xuyên bị các mô hình cũ hơn và rẻ hơn qua mặt:
* Trên bài test SWE-Bench Pro, mô hình này nhận thất bại trước Grok 4.5 (phiên bản ra mắt hôm 8/7).
* Trên MLE Bench, Gemini 3.6 Flash tiếp tục bị Claude Sonnet 5 đánh bại.
Màn thể hiện này khiến Gemini 3.6 Flash bị đánh giá là một trong những sản phẩm AI gây thất vọng nhất mà Google từng phát hành.
Trong lần cập nhật này, Google cũng mang đến hai lựa chọn khác là Gemini 3.5 Flash-Lite — phiên bản tiết kiệm chi phí với tốc độ cung cấp 350 token đầu ra mỗi giây, và Gemini 3.5 Flash Cyber được thiết kế riêng cho các tác vụ an ninh mạng.
Thông số công bố hấp dẫn nhưng chọn sai thời điểm
Google chào sân Gemini 3.6 Flash với cửa sổ ngữ cảnh lên tới 1 triệu token, tương đương khoảng 1.500 trang văn bản A4, 30.000 dòng mã hoặc 1 giờ video. Mô hình hỗ trợ đa dạng dữ liệu đầu vào từ văn bản, hình ảnh, giọng nói đến video, với mức giá 7,5 USD cho mỗi triệu token đầu ra. Google cũng cho biết mô hình mới này tiêu thụ ít hơn 17% token đầu ra trong các quy trình làm việc nhiều bước.
Tuy nhiên, thời điểm xuất hiện của Gemini 3.6 Flash lại không mấy thuận lợi. Thị trường đang chứng kiến sự trỗi dậy mạnh mẽ từ các mô hình AI mã nguồn mở đến từ Trung Quốc, điển hình như Kimi K3 của Moonshot, vốn đang chiếm ưu thế nhờ các cải tiến kiến trúc giúp tối ưu chi phí mà vẫn giữ hiệu suất rất cao.
Điểm benchmark lép vế trước dàn đối thủ
Điều khiến cộng đồng thất vọng nhất chính là khả năng thực chiến. Trong Báo cáo Chỉ số AI (AI Index), Gemini 3.6 Flash chỉ đạt 50 điểm, ngậm ngùi xếp sau một loạt tên tuổi như Meta Spark 1.1, GLM-5.2, GPT-5.6 Luna, Sonnet 5, Grok 4.5 và GPT-5.6 Terra.
Khi đi sâu vào từng bài kiểm tra cụ thể, Gemini 3.6 Flash thường xuyên bị các mô hình cũ hơn và rẻ hơn qua mặt:
* Trên bài test SWE-Bench Pro, mô hình này nhận thất bại trước Grok 4.5 (phiên bản ra mắt hôm 8/7).
* Trên MLE Bench, Gemini 3.6 Flash tiếp tục bị Claude Sonnet 5 đánh bại.
Màn thể hiện này khiến Gemini 3.6 Flash bị đánh giá là một trong những sản phẩm AI gây thất vọng nhất mà Google từng phát hành.
Trong lần cập nhật này, Google cũng mang đến hai lựa chọn khác là Gemini 3.5 Flash-Lite — phiên bản tiết kiệm chi phí với tốc độ cung cấp 350 token đầu ra mỗi giây, và Gemini 3.5 Flash Cyber được thiết kế riêng cho các tác vụ an ninh mạng.