• banner tin tuc 01
  • Banner tin tưc 02

Google tung Gemini 3.8 Flash: Mạnh hơn, rẻ hơn nhưng vẫn khiến người dùng ngóng bản Pro

 Google vừa tiếp tục làm mới dòng Gemini với phiên bản 3.8 Flash, nhưng thay vì đưa ra model cao cấp mà giới công nghệ mong chờ, hãng vẫn tập trung vào phân khúc Flash có chi phí thấp và tốc độ xử lý nhanh.
 Ngày 2/9, Google chính thức giới thiệu Gemini 3.8 Flash cùng phiên bản chuyên biệt về an ninh mạng Gemini 3.8 Flash Cyber. Động thái này diễn ra chỉ một ngày sau khi Anthropic công bố loạt model mới Claude Fable 5.1 và Mythos 5.1.

Điểm đáng chú ý là trong lúc Anthropic tập trung nâng cấp nhóm model mạnh nhất, Google tiếp tục phát triển dòng Flash. Điều này càng khiến cộng đồng công nghệ đặt câu hỏi về thời điểm Gemini 3.5 Pro – model đầu bảng được chờ đợi trong nhiều tháng – mới xuất hiện.

Ba phiên bản Flash liên tiếp trong vòng 6 tuần

Gemini 3.8 Flash là bản Flash thứ ba được Google tung ra chỉ trong khoảng 6 tuần. Trước đó, Gemini 3.6 Flash xuất hiện ngày 21/7, tiếp đến là Gemini 3.7 Flash vào ngày 13/8.

seeding-facebook-hieu-qua-2026Trong khi đó, Google vẫn chưa công bố lịch phát hành chính thức cho Gemini 3.5 Pro. Hồi tháng 7, CEO Sundar Pichai từng cho biết model này đang được thử nghiệm cùng các đối tác.

Đầu tháng 8, Google cũng có sự thay đổi đáng chú ý tại DeepMind. Demis Hassabis rời vai trò điều hành hàng ngày để đảm nhận vị trí Chủ tịch, trong khi Koray Kavukcuoglu, cựu Giám đốc công nghệ DeepMind, tiếp quản hoạt động phát triển Gemini và báo cáo trực tiếp cho Sundar Pichai.

Giá rẻ nhưng hiệu năng được Google đẩy mạnh

Gemini 3.8 Flash được Google giữ mức giá tương tự phiên bản 3.7 Flash. Model có giá 0,75 USD cho mỗi triệu token đầu vào và 3,75 USD cho mỗi triệu token đầu ra, tương đương khoảng 19.700 đồng và 98.600 đồng.

Mức giá này được áp dụng đến hết năm 2026. Từ ngày 1/1/2027, chi phí sẽ tăng lên lần lượt 1,50 USD và 7,50 USD cho mỗi triệu token.

Theo Google, Gemini 3.8 Flash có thể vượt qua nhiều model đầu bảng lớn hơn trong bài kiểm tra DeepSWE v1.1, vốn đánh giá khả năng xử lý các nhiệm vụ kỹ thuật phần mềm phức tạp trong thời gian dài.

Model mới cũng đạt kết quả tốt hơn Gemini 3.7 Flash và một số model cao cấp trên hai benchmark chuyên ngành là Vals Finance Agent V2 và Harvey Legal Agent Benchmark. Trên HLE-Verified, bài kiểm tra khả năng suy luận nhiều bước thuộc nhiều lĩnh vực, Gemini 3.8 Flash đạt 54,9%.

Một trong những lý do giúp model đạt hiệu suất cao là khả năng dành thêm tài nguyên cho quá trình suy luận. Khi thiết lập mức effort cao, Gemini có thể tự thực hiện nhiều bước suy luận và gọi công cụ nhiều lần hơn, đồng nghĩa lượng token sử dụng cũng tăng.

Ngược lại, người dùng có thể giảm effort nếu muốn tối ưu chi phí. Với những tác vụ yêu cầu hiệu quả token cao, Google vẫn khuyến nghị sử dụng Gemini 3.7 Flash.

seeding-facebook-hieu-qua-2026Cách tiếp cận này cũng mở ra nhiều ứng dụng thực tế cho doanh nghiệp, từ phát triển phần mềm đến tự động hóa nội dung, phân tích dữ liệu hay tối ưu quảng cáo facebook, nơi tốc độ xử lý và chi phí API có thể ảnh hưởng trực tiếp đến hiệu quả vận hành.

Có thể tự xây game 3D chỉ bằng một câu lệnh

Để chứng minh khả năng của Gemini 3.8 Flash, Google đã cho model tự xây dựng một game 3D hoàn chỉnh với nhân vật phù thủy khám phá lâu đài chỉ từ một câu lệnh trong công cụ lập trình Google Antigravity. Phần texture được tạo bằng Nano Banana.

Model cũng có thể dựng một phiên bản Google Maps mang phong cách giao diện DOS có khả năng tương tác, bao gồm tính năng chỉ đường và Street View, cũng chỉ với một câu lệnh.

Ngoài ra, Google trình diễn khả năng tạo công cụ trực quan hóa địa hình 3D dựa trên dữ liệu thực tế từ Cơ quan Khảo sát Địa chất Mỹ.

Những màn trình diễn này cho thấy Google đang hướng Gemini Flash tới nhóm tác vụ có mức độ tự động hóa ngày càng cao, thay vì chỉ đóng vai trò chatbot trả lời câu hỏi.

Gemini 3.8 Flash Cyber được kiểm soát chặt

Một điểm khác biệt đáng chú ý là Gemini 3.8 Flash Cyber, phiên bản được thiết kế dành cho lĩnh vực an ninh mạng.

Google không phát hành rộng rãi model này mà chỉ cung cấp cho các tổ chức được xem là "bên phòng thủ đáng tin cậy" thông qua chương trình Fairwind. Đối tượng có thể bao gồm cơ quan chính phủ, đơn vị vận hành hạ tầng trọng yếu và các tổ chức bảo trì phần mềm.

Cách làm này tương đồng với chiến lược Anthropic áp dụng cho Mythos 5.1 thông qua Cyber Verification Program và Life Sciences Verification Program. Các model phổ thông được kiểm soát an toàn chặt chẽ, trong khi những phiên bản có năng lực đặc biệt được giới hạn cho các tổ chức đáp ứng điều kiện nhất định - nguồn tin được tổng hợp từ Facebook.

Trên CyberGym, benchmark chuyên đánh giá khả năng tự động phát hiện lỗ hổng, Gemini 3.8 Flash Cyber được Google cho biết vượt qua cả Gemini 3.5 Flash Cyber và một số model đầu bảng lớn hơn.

Trong bộ thử nghiệm nội bộ với 20 ngôn ngữ lập trình, tỷ lệ phát hiện lỗ hổng thành công vượt 70%.

Trên CWE-Bench, benchmark đánh giá khả năng vá lỗi độc lập do Collinear vận hành, model đạt pass@1 47,2%. Con số này gần với model đầu bảng đang dẫn đầu ở mức 47,8%, nhưng chi phí vận hành được cho là thấp hơn đáng kể.

Google cũng đưa ra một số trường hợp sử dụng thực tế. Đội Chrome Security tạo ra lượng bản vá chính xác cao gấp 2,6 lần so với khi sử dụng các model thương mại lớn hơn. Công ty an ninh mạng Wiz ghi nhận độ chính xác phát hiện lỗ hổng tăng 7,5-9,7%, trong khi chi phí thấp hơn 2,3-5,2 lần so với một số model đầu bảng.

seeding-facebook-hieu-qua-2026Đáng chú ý, Cloud Vulnerability Research của Google cho biết Gemini 3.8 Flash Cyber đã phát hiện một lỗ hổng nghiêm trọng trong nền tảng chỉ trong chưa đầy 2 giờ, thay vì khoảng thời gian có thể kéo dài tới nhiều tháng với quy trình truyền thống.

Từng được thử nghiệm với Claude Opus 5

Trước thời điểm ra mắt, một số nguồn tin được Wall Street Journal dẫn lại cho biết các kỹ sư Google từng thử nghiệm model này trong nội bộ dưới mật danh Skimaki.

Trong một thử nghiệm trên nền tảng lập trình Jetski, model của Google được đặt cạnh Claude Opus 5 của Anthropic. Phần lớn kỹ sư tham gia được cho là ưu tiên model mới của Google nhờ độ trễ thấp hơn và ít lỗi hơn.

Tuy nhiên, Google không đề cập đến phép so sánh này trong bài công bố chính thức Gemini 3.8 Flash.


Bài viết khác