Phạm Thanh Bình✔
Writer
Google đang đẩy nhanh quá trình cải tiến mô hình Gemini một lần nữa.
Vào thứ Năm, ngày 13 (giờ miền Đông), Google đã thông báo ra mắt Gemini 3.7 Flash, tập trung vào lập trình và các tác nhân thông minh.(Agent) và các quy trình làm việc phức tạp. Google tuyên bố đây là "mô hình làm việc thông minh nhất" của họ cho đến nay, với những cải tiến hơn nữa so với phiên bản tiền nhiệm ở các lĩnh vực như gỡ lỗi mã, tạo mã cấp độ sản xuất và thực thi tác vụ nhiều bước.
Đây là phiên bản Flash thứ tư được Google phát hành gần đây. Vào ngày 22 tháng 7, một ngày trước khi Alphabet, công ty mẹ của Google, công bố báo cáo tài chính, Google đã ra mắt ba phiên bản cùng một lúc: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber, tất cả đều nhắm đến các tác nhân AI và quy trình làm việc của nhà phát triển. Giờ đây, chưa đầy một tháng sau, Gemini Flash lại nhận được một bản cập nhật khác.
Google cũng đang nhấn mạnh giá cả như một điểm bán hàng quan trọng: giá bán lậu của Gemini 3.7 Flash sẽ là [giá chưa được công bố] vào cuối năm nay.Nhập Token với giá 0,75 đô la cho mỗi triệu token.3,75 đô la cho mỗi triệu token, bằng một nửa giá ban đầu của Gemini 3.6 Flash.
Tuy nhiên, trong khi dòng sản phẩm Flash đang được cải tiến nhanh chóng, mẫu flagship Gemini 3.5 Pro, vốn thu hút nhiều sự chú ý hơn trên thị trường, vẫn chưa có ngày ra mắt chính thức. Việc trì hoãn ra mắt này đã làm dấy lên nhiều câu hỏi từ các nhà đầu tư về lộ trình phát triển của Google, đặc biệt là trong các lĩnh vực như lập trình trí tuệ nhân tạo (AI). Các báo cáo truyền thông cho thấy sự không chắc chắn về ngày ra mắt của mẫu flagship tiếp theo càng làm dấy lên nghi ngờ về khả năng của Google trong việc vượt qua các đối thủ cạnh tranh và chuyển đổi thành công các khoản đầu tư khổng lồ vào AI thành các công cụ và dịch vụ dẫn đầu thị trường.
Google cho biết mô hình mới mang lại những cải tiến đáng kể so với thế hệ trước về khả năng gỡ lỗi, giải quyết vấn đề và tạo mã sẵn sàng cho sản xuất, cho phép phát triển ứng dụng với ít thao tác nhắc nhở hơn và cải thiện trải nghiệm người dùng cho các nhà phát triển trong các tác vụ nhiều bước.
Từ góc độ định vị, Flash 3.7 không chỉ đơn thuần theo đuổi tốc độ phản hồi nhanh hơn, mà còn tiến xa hơn nữa hướng tới một mô hình hoạt động "có khả năng hoàn thành nhiệm vụ".
Dữ liệu thử nghiệm của Google cho thấy trong bài kiểm tra chính FrontierCode 1.1, Gemini 3.7 Flash đạt 43,6%, cao hơn so với 34,4% của 3.6 Flash; trong bài kiểm tra DeepSWE v1.1, điểm số đã cải thiện từ 49,0% lên 65,3%. Trong WebDev Arena, mô hình mới đạt điểm Elo là 1588, cũng cao hơn so với 1538 của 3.6 Flash.
Những khả năng này đặc biệt quan trọng đối với lập trình AI. Điều mà các nhà phát triển thực sự cần không chỉ là mô hình tạo ra một vài đoạn mã, mà là mô hình có thể hiểu mã hiện có, xác định lỗi, gọi các công cụ, thực hiện sửa đổi và cuối cùng cung cấp một ứng dụng hoạt động.
Google cho biết Flash 3.7 có khả năng "suy nghĩ" sâu sắc hơn về việc lập kế hoạch nhiều bước và các lệnh gọi công cụ, đồng thời điều chỉnh chiến lược tốt hơn khi gặp trở ngại trong quá trình thực thi, nhờ đó giảm thiểu các lời nhắc lặp đi lặp lại và sự can thiệp thủ công từ người dùng.
Giá giới thiệu của Google là 0,75 đô la cho mỗi triệu token đầu vào và 3,75 đô la cho mỗi triệu token đầu ra, có hiệu lực đến ngày 31 tháng 12 năm 2026. Từ ngày 1 tháng 1 năm 2027, giá sẽ trở lại mức 1,50 đô la cho mỗi triệu token đầu vào và 7,50 đô la cho mỗi triệu token đầu ra.
Nói cách khác, đến cuối năm nay, chi phí để các nhà phát triển sử dụng Flash 3.7 sẽ chỉ bằng một nửa so với giá ban đầu của Flash 3.6.
Chiến lược này phù hợp với chiến lược gần đây của Google về việc nhanh chóng triển khai các mô hình Flash: bằng cách nâng cao khả năng của mô hình, giảm độ trễ và giảm chi phí token, Flash có thể trở thành mô hình nền tảng cho việc triển khai quy mô lớn các tác nhân AI.
Trên thực tế, ba phiên bản Flash mà Google ra mắt vào ngày 21 tháng 7 đã phản ánh hướng đi này. Gemini 3.6 Flash được Google định vị là mô hình "làm việc" dành cho lập trình, công việc trí tuệ và các tác vụ đa phương thức; 3.5 Flash-Lite nhấn mạnh độ trễ thấp và thông lượng cao, phù hợp với các kịch bản có số lượng cuộc gọi lớn như tìm kiếm tác nhân và xử lý tài liệu; và 3.5 Flash Cyber được thiết kế cho các tác vụ an ninh mạng và được tích hợp với các tác nhân bảo mật mã CodeMender.
Ngày nay, Flash 3.7 tiếp tục tiến bước theo hướng "hiệu năng cao + tiết kiệm chi phí cao", và Google rõ ràng hy vọng sẽ cạnh tranh để thu hút thêm nhiều nhà phát triển và người dùng doanh nghiệp trong quá trình thương mại hóa nhanh chóng các tác nhân AI.
Vào ngày 21 tháng 7, khi ra mắt Flash 3.6, Flash-Lite 3.5 và Flash Cyber 3.5, Google tuyên bố rằng Gemini 3.5 Pro đang được thử nghiệm với các đối tác và dự kiến sẽ được phát hành cho nhiều người dùng hơn ngay khi "sẵn sàng". Đồng thời, Google cũng thông báo rằng họ đã khởi động vòng huấn luyện trước đầy tham vọng nhất từ trước đến nay cho Gemini 4.
Tuy nhiên, tính đến ngày 13 tháng 8, khi Gemini 3.7 Flash được ra mắt, Google vẫn chưa công bố ngày phát hành chính thức cho Gemini 3.5 Pro.
Điều này tạo ra sự tương phản rõ rệt trong dòng sản phẩm AI của Google: dòng Flash được cập nhật thường xuyên, nhưng dòng Pro, vốn thực sự cạnh tranh với các sản phẩm chủ lực, vẫn thiếu một lộ trình phát triển rõ ràng.
Các nhà bình luận đã chỉ ra rằng việc trì hoãn ra mắt MacBook Pro 3.5 inch đã thu hút sự chú ý của các nhà đầu tư vào lộ trình phát triển sản phẩm AI của Google, đặc biệt là trong các lĩnh vực có giá trị thương mại tăng nhanh như lập trình AI. Với việc OpenAI và Anthropic tiếp tục phát triển các mô hình hàng đầu của họ, thời điểm ra mắt mô hình chủ lực tiếp theo của Google đã trở thành một chỉ báo quan trọng để thị trường đánh giá khả năng cạnh tranh về AI của hãng.
Một số phương tiện truyền thông cũng chỉ ra rằng Google trước đó đã tuyên bố vào tháng 7 rằng phiên bản 3.5 Pro đang được thử nghiệm với các đối tác và sẽ sớm ra mắt, nhưng không có ngày phát hành cụ thể nào được cung cấp khi phiên bản 3.7 Flash được phát hành.
Nói cách khác, Google hiện đang tăng cường khả năng cạnh tranh trong lĩnh vực "ứng dụng trí tuệ nhân tạo" thông qua việc liên tục cải tiến dòng sản phẩm Flash, nhưng thị trường vẫn đang chờ đợi câu trả lời từ cuộc chiến giữa các mô hình tiên tiến nhất, điều sẽ quyết định giới hạn tối đa của khả năng trí tuệ nhân tạo.

Trong cuộc họp báo cáo thu nhập hồi tháng 7, CEO của Alphabet và Google, Sundar Pichai, cho biết công ty hy vọng sẽ triển khai các mô hình nhanh hơn và đã đầu tư đáng kể nguồn lực điện toán vào việc đào tạo thế hệ tiếp theo Gemini 4.
Trước khi Alphabet công bố báo cáo tài chính vào ngày 22 tháng 7, Google đã đi đầu trong việc cập nhật mạnh mẽ dòng sản phẩm Flash: vào ngày 21 tháng 7, họ phát hành Flash 3.6, Flash-Lite 3.5 và Flash Cyber 3.5 cùng một ngày; và vào ngày 13 tháng 8, họ ra mắt Flash 3.7.
Về tốc độ ra mắt sản phẩm, Google rõ ràng đang rút ngắn chu kỳ phát triển của dòng sản phẩm Flash. Điều này không chỉ nhằm bắt kịp tốc độ ra mắt sản phẩm của các đối thủ cạnh tranh, mà còn để nắm bắt điểm khởi đầu về cơ sở hạ tầng cho các nhà phát triển và ứng dụng doanh nghiệp khi các trợ lý AI bắt đầu chuyển từ "trò chuyện" sang thực hiện các tác vụ thực tế.
Google đã tăng cường hơn nữa khả năng bảo mật của Flash 3.7, bao gồm bảo vệ chống lại các cuộc tấn công mạng độc hại và việc lạm dụng các vật liệu hóa học, sinh học, phóng xạ và hạt nhân nguy hiểm, đồng thời giảm thiểu sự gián đoạn đối với các ứng dụng phát triển và nghiên cứu thông thường.
Hiện tại, Gemini 3.7 Flash có sẵn thông qua Google Antigravity và API Gemini, và có thể được sử dụng trong Google AI Studio và Android Studio. Trợ lý năng suất AI của Google, Gemini Spark, cũng sẽ sử dụng Flash 3.7 bắt đầu từ ngày 13 tháng 8.
Do đó, ý nghĩa của Gemini 3.7 Flash có thể không chỉ đơn thuần là "một mô hình mới" - Google đang cạnh tranh thị trường ứng dụng AI bằng các phiên bản Flash nhanh hơn, khả năng lập trình và tác nhân thông minh mạnh mẽ hơn, cùng với giá token thấp hơn; nhưng đồng thời, thời điểm Gemini 3.5 Pro thực sự được ra mắt vẫn là một mảnh ghép quan trọng trong bản đồ cạnh tranh AI của Google mà chưa được hoàn thiện.
Vào thứ Năm, ngày 13 (giờ miền Đông), Google đã thông báo ra mắt Gemini 3.7 Flash, tập trung vào lập trình và các tác nhân thông minh.(Agent) và các quy trình làm việc phức tạp. Google tuyên bố đây là "mô hình làm việc thông minh nhất" của họ cho đến nay, với những cải tiến hơn nữa so với phiên bản tiền nhiệm ở các lĩnh vực như gỡ lỗi mã, tạo mã cấp độ sản xuất và thực thi tác vụ nhiều bước.
Đây là phiên bản Flash thứ tư được Google phát hành gần đây. Vào ngày 22 tháng 7, một ngày trước khi Alphabet, công ty mẹ của Google, công bố báo cáo tài chính, Google đã ra mắt ba phiên bản cùng một lúc: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber, tất cả đều nhắm đến các tác nhân AI và quy trình làm việc của nhà phát triển. Giờ đây, chưa đầy một tháng sau, Gemini Flash lại nhận được một bản cập nhật khác.
Google cũng đang nhấn mạnh giá cả như một điểm bán hàng quan trọng: giá bán lậu của Gemini 3.7 Flash sẽ là [giá chưa được công bố] vào cuối năm nay.Nhập Token với giá 0,75 đô la cho mỗi triệu token.3,75 đô la cho mỗi triệu token, bằng một nửa giá ban đầu của Gemini 3.6 Flash.
Tuy nhiên, trong khi dòng sản phẩm Flash đang được cải tiến nhanh chóng, mẫu flagship Gemini 3.5 Pro, vốn thu hút nhiều sự chú ý hơn trên thị trường, vẫn chưa có ngày ra mắt chính thức. Việc trì hoãn ra mắt này đã làm dấy lên nhiều câu hỏi từ các nhà đầu tư về lộ trình phát triển của Google, đặc biệt là trong các lĩnh vực như lập trình trí tuệ nhân tạo (AI). Các báo cáo truyền thông cho thấy sự không chắc chắn về ngày ra mắt của mẫu flagship tiếp theo càng làm dấy lên nghi ngờ về khả năng của Google trong việc vượt qua các đối thủ cạnh tranh và chuyển đổi thành công các khoản đầu tư khổng lồ vào AI thành các công cụ và dịch vụ dẫn đầu thị trường.
Từ "viết mã" đến "cung cấp ứng dụng", mô hình mới giúp nâng cao hiệu quả thực hiện các tác vụ phức tạp.
Rõ ràng, Google đã tập trung các nâng cấp cốt lõi cho Gemini 3.7 Flash vào lập trình và các quy trình làm việc phức tạp.Google cho biết mô hình mới mang lại những cải tiến đáng kể so với thế hệ trước về khả năng gỡ lỗi, giải quyết vấn đề và tạo mã sẵn sàng cho sản xuất, cho phép phát triển ứng dụng với ít thao tác nhắc nhở hơn và cải thiện trải nghiệm người dùng cho các nhà phát triển trong các tác vụ nhiều bước.
Từ góc độ định vị, Flash 3.7 không chỉ đơn thuần theo đuổi tốc độ phản hồi nhanh hơn, mà còn tiến xa hơn nữa hướng tới một mô hình hoạt động "có khả năng hoàn thành nhiệm vụ".
Dữ liệu thử nghiệm của Google cho thấy trong bài kiểm tra chính FrontierCode 1.1, Gemini 3.7 Flash đạt 43,6%, cao hơn so với 34,4% của 3.6 Flash; trong bài kiểm tra DeepSWE v1.1, điểm số đã cải thiện từ 49,0% lên 65,3%. Trong WebDev Arena, mô hình mới đạt điểm Elo là 1588, cũng cao hơn so với 1538 của 3.6 Flash.
Những khả năng này đặc biệt quan trọng đối với lập trình AI. Điều mà các nhà phát triển thực sự cần không chỉ là mô hình tạo ra một vài đoạn mã, mà là mô hình có thể hiểu mã hiện có, xác định lỗi, gọi các công cụ, thực hiện sửa đổi và cuối cùng cung cấp một ứng dụng hoạt động.
Google cho biết Flash 3.7 có khả năng "suy nghĩ" sâu sắc hơn về việc lập kế hoạch nhiều bước và các lệnh gọi công cụ, đồng thời điều chỉnh chiến lược tốt hơn khi gặp trở ngại trong quá trình thực thi, nhờ đó giảm thiểu các lời nhắc lặp đi lặp lại và sự can thiệp thủ công từ người dùng.
Việc mua lại thị trường tác nhân thông minh với chi phí thấp đã khiến giá token giảm xuống còn một nửa so với thế hệ trước.
Bên cạnh những cải tiến về hiệu năng, giá cả cũng là một ưu điểm vượt trội của Gemini 3.7 Flash.Giá giới thiệu của Google là 0,75 đô la cho mỗi triệu token đầu vào và 3,75 đô la cho mỗi triệu token đầu ra, có hiệu lực đến ngày 31 tháng 12 năm 2026. Từ ngày 1 tháng 1 năm 2027, giá sẽ trở lại mức 1,50 đô la cho mỗi triệu token đầu vào và 7,50 đô la cho mỗi triệu token đầu ra.
Nói cách khác, đến cuối năm nay, chi phí để các nhà phát triển sử dụng Flash 3.7 sẽ chỉ bằng một nửa so với giá ban đầu của Flash 3.6.
Chiến lược này phù hợp với chiến lược gần đây của Google về việc nhanh chóng triển khai các mô hình Flash: bằng cách nâng cao khả năng của mô hình, giảm độ trễ và giảm chi phí token, Flash có thể trở thành mô hình nền tảng cho việc triển khai quy mô lớn các tác nhân AI.
Trên thực tế, ba phiên bản Flash mà Google ra mắt vào ngày 21 tháng 7 đã phản ánh hướng đi này. Gemini 3.6 Flash được Google định vị là mô hình "làm việc" dành cho lập trình, công việc trí tuệ và các tác vụ đa phương thức; 3.5 Flash-Lite nhấn mạnh độ trễ thấp và thông lượng cao, phù hợp với các kịch bản có số lượng cuộc gọi lớn như tìm kiếm tác nhân và xử lý tài liệu; và 3.5 Flash Cyber được thiết kế cho các tác vụ an ninh mạng và được tích hợp với các tác nhân bảo mật mã CodeMender.
Ngày nay, Flash 3.7 tiếp tục tiến bước theo hướng "hiệu năng cao + tiết kiệm chi phí cao", và Google rõ ràng hy vọng sẽ cạnh tranh để thu hút thêm nhiều nhà phát triển và người dùng doanh nghiệp trong quá trình thương mại hóa nhanh chóng các tác nhân AI.
Flash đang đẩy nhanh tốc độ phát triển các phiên bản mới, nhưng sản phẩm chủ lực về trí tuệ nhân tạo của Google vẫn đang được chờ đợi.
Tuy nhiên, đối với các nhà đầu tư, việc dòng sản phẩm Flash liên tục được nâng cấp nhanh chóng không thể che giấu hoàn toàn thực tế rằng mẫu sản phẩm chủ lực đã bị trì hoãn.Vào ngày 21 tháng 7, khi ra mắt Flash 3.6, Flash-Lite 3.5 và Flash Cyber 3.5, Google tuyên bố rằng Gemini 3.5 Pro đang được thử nghiệm với các đối tác và dự kiến sẽ được phát hành cho nhiều người dùng hơn ngay khi "sẵn sàng". Đồng thời, Google cũng thông báo rằng họ đã khởi động vòng huấn luyện trước đầy tham vọng nhất từ trước đến nay cho Gemini 4.
Tuy nhiên, tính đến ngày 13 tháng 8, khi Gemini 3.7 Flash được ra mắt, Google vẫn chưa công bố ngày phát hành chính thức cho Gemini 3.5 Pro.
Điều này tạo ra sự tương phản rõ rệt trong dòng sản phẩm AI của Google: dòng Flash được cập nhật thường xuyên, nhưng dòng Pro, vốn thực sự cạnh tranh với các sản phẩm chủ lực, vẫn thiếu một lộ trình phát triển rõ ràng.
Các nhà bình luận đã chỉ ra rằng việc trì hoãn ra mắt MacBook Pro 3.5 inch đã thu hút sự chú ý của các nhà đầu tư vào lộ trình phát triển sản phẩm AI của Google, đặc biệt là trong các lĩnh vực có giá trị thương mại tăng nhanh như lập trình AI. Với việc OpenAI và Anthropic tiếp tục phát triển các mô hình hàng đầu của họ, thời điểm ra mắt mô hình chủ lực tiếp theo của Google đã trở thành một chỉ báo quan trọng để thị trường đánh giá khả năng cạnh tranh về AI của hãng.
Một số phương tiện truyền thông cũng chỉ ra rằng Google trước đó đã tuyên bố vào tháng 7 rằng phiên bản 3.5 Pro đang được thử nghiệm với các đối tác và sẽ sớm ra mắt, nhưng không có ngày phát hành cụ thể nào được cung cấp khi phiên bản 3.7 Flash được phát hành.
Nói cách khác, Google hiện đang tăng cường khả năng cạnh tranh trong lĩnh vực "ứng dụng trí tuệ nhân tạo" thông qua việc liên tục cải tiến dòng sản phẩm Flash, nhưng thị trường vẫn đang chờ đợi câu trả lời từ cuộc chiến giữa các mô hình tiên tiến nhất, điều sẽ quyết định giới hạn tối đa của khả năng trí tuệ nhân tạo.

Google đang đặt cược vào tốc độ cải tiến nhanh hơn, và Gemini 4 hiện đang trong giai đoạn huấn luyện.
Động thái của Google không phải là một sự việc cá biệt, mà là một phần trong chiến lược nhằm đẩy nhanh quá trình phát triển các mô hình trí tuệ nhân tạo.Trong cuộc họp báo cáo thu nhập hồi tháng 7, CEO của Alphabet và Google, Sundar Pichai, cho biết công ty hy vọng sẽ triển khai các mô hình nhanh hơn và đã đầu tư đáng kể nguồn lực điện toán vào việc đào tạo thế hệ tiếp theo Gemini 4.
Trước khi Alphabet công bố báo cáo tài chính vào ngày 22 tháng 7, Google đã đi đầu trong việc cập nhật mạnh mẽ dòng sản phẩm Flash: vào ngày 21 tháng 7, họ phát hành Flash 3.6, Flash-Lite 3.5 và Flash Cyber 3.5 cùng một ngày; và vào ngày 13 tháng 8, họ ra mắt Flash 3.7.
Về tốc độ ra mắt sản phẩm, Google rõ ràng đang rút ngắn chu kỳ phát triển của dòng sản phẩm Flash. Điều này không chỉ nhằm bắt kịp tốc độ ra mắt sản phẩm của các đối thủ cạnh tranh, mà còn để nắm bắt điểm khởi đầu về cơ sở hạ tầng cho các nhà phát triển và ứng dụng doanh nghiệp khi các trợ lý AI bắt đầu chuyển từ "trò chuyện" sang thực hiện các tác vụ thực tế.
Google đã tăng cường hơn nữa khả năng bảo mật của Flash 3.7, bao gồm bảo vệ chống lại các cuộc tấn công mạng độc hại và việc lạm dụng các vật liệu hóa học, sinh học, phóng xạ và hạt nhân nguy hiểm, đồng thời giảm thiểu sự gián đoạn đối với các ứng dụng phát triển và nghiên cứu thông thường.
Hiện tại, Gemini 3.7 Flash có sẵn thông qua Google Antigravity và API Gemini, và có thể được sử dụng trong Google AI Studio và Android Studio. Trợ lý năng suất AI của Google, Gemini Spark, cũng sẽ sử dụng Flash 3.7 bắt đầu từ ngày 13 tháng 8.
Do đó, ý nghĩa của Gemini 3.7 Flash có thể không chỉ đơn thuần là "một mô hình mới" - Google đang cạnh tranh thị trường ứng dụng AI bằng các phiên bản Flash nhanh hơn, khả năng lập trình và tác nhân thông minh mạnh mẽ hơn, cùng với giá token thấp hơn; nhưng đồng thời, thời điểm Gemini 3.5 Pro thực sự được ra mắt vẫn là một mảnh ghép quan trọng trong bản đồ cạnh tranh AI của Google mà chưa được hoàn thiện.