Mô hình
Google tung Gemini 1.5 Flash-8B: Bản cập nhật dồn dập trong bối cảnh đối đầu Anthropic
(giờ Việt Nam)
Tóm tắt AI
Google tiếp tục đẩy nhanh tiến độ với bản cập nhật Flash thứ ba chỉ trong 6 tuần, ngay khi Anthropic vừa nâng cấp loạt model chủ lực. Tuy nhiên, người dùng vẫn đang chờ đợi phiên bản Pro thế hệ mới.
Bản dịch AI
Bản cập nhật Flash thứ ba trong 6 tuần của Google xuất hiện đúng lúc Anthropic vừa nâng cấp toàn bộ dòng model hàng đầu của họ.
Ngày 2/9, Google ra mắt Gemini 3.8 Flash và biến thể an ninh mạng Gemini 3.8 Flash Cyber, chỉ một ngày sau khi Anthropic tung ra Claude Fable 5.1 và Mythos 5.1. Tuy nhiên, trong khi Anthropic nâng cấp trực tiếp vào dòng model mạnh nhất của mình, Google lại tiếp tục tung ra một bản Flash – phân khúc tầm trung giá rẻ – thay vì Gemini 3.5 Pro, model đầu bảng mà giới công nghệ đã chờ đợi suốt nhiều tháng qua.
Google công bố Gemini 3.8 Flash và 3.8 Flash Cyber trên blog chính thức.
Đây đã là bản Flash thứ ba Google ra mắt chỉ trong 6 tuần, sau Gemini 3.6 Flash ngày 21/7 và Gemini 3.7 Flash ngày 13/8. Trong khi đó, Gemini 3.5 Pro, model đầu bảng thực sự của hãng, vẫn chưa có ngày ra mắt cụ thể, dù CEO Sundar Pichai từng cho biết hồi tháng 7 rằng model này đang được thử nghiệm cùng các đối tác. Đầu tháng 8, Google cũng thay đổi nhân sự cấp cao tại DeepMind: Demis Hassabis rời vị trí điều hành hàng ngày để giữ vai trò Chủ tịch, còn Koray Kavukcuoglu, cựu Giám đốc công nghệ DeepMind, tiếp quản việc phát triển Gemini và báo cáo trực tiếp cho Sundar Pichai.
Về giá cả, Gemini 3.8 Flash giữ nguyên mức giới thiệu của bản 3.7 Flash: 0,75 USD cho mỗi triệu token đầu vào và 3,75 USD cho mỗi triệu token đầu ra (tương đương khoảng 19.700 đồng và 98.600 đồng), áp dụng đến hết năm 2026. Từ ngày 1/1/2027, giá sẽ tăng lên 1,50 USD và 7,50 USD (tương đương khoảng 39.400 đồng và 197.000 đồng).
Google cho biết Gemini 3.8 Flash vượt qua phần lớn các model đầu bảng lớn hơn trên DeepSWE v1.1 – benchmark đo lường khả năng tự giải quyết các bài toán kỹ thuật phần mềm phức tạp – dù có chi phí thấp hơn nhiều. Model này cũng dẫn trước cả Gemini 3.7 Flash lẫn các model đầu bảng khác trên hai benchmark chuyên ngành là Vals Finance Agent V2 và Harvey Legal Agent Benchmark, đồng thời đạt 54,9% trên HLE-Verified, bài kiểm tra suy luận nhiều bước trải rộng trên các lĩnh vực khoa học, nhân văn và chuyên môn. Cách model này đạt điểm cao là nhờ "làm việc chăm chỉ hơn": tự thêm các bước suy luận và gọi công cụ nhiều lần hơn, điều này có thể tiêu tốn nhiều token hơn khi thiết lập mức độ nỗ lực (effort) cao. Google khuyến nghị hạ mức effort nếu ưu tiên tiết kiệm chi phí, hoặc tiếp tục sử dụng Gemini 3.7 Flash cho các tác vụ cần tối ưu hóa token.
Bảng so sánh hiệu năng của Gemini 3.8 Flash với các model đầu bảng khác.
Để trình diễn năng lực, Google đã để Gemini 3.8 Flash tự xây dựng một game 3D hoàn chỉnh (nhân vật phù thủy khám phá lâu đài) chỉ từ một câu lệnh trong công cụ lập trình Google Antigravity, sử dụng texture tạo bởi Nano Banana. Model này cũng dựng được bản Google Maps giao diện DOS có thể chơi được, bao gồm tính năng chỉ đường và Street View, cũng chỉ từ một câu lệnh, kết hợp với một công cụ trực quan hóa địa hình 3D sử dụng dữ liệu thực từ Cơ quan Khảo sát Địa chất Mỹ.
Đáng chú ý nhất là cách Google xử lý Gemini 3.8 Flash Cyber. Bản này chỉ mở cho "bên phòng thủ đáng tin cậy" thông qua chương trình mới mang tên Fairwind, bao gồm các cơ quan chính phủ, đơn vị vận hành hạ tầng trọng yếu và các nhà bảo trì phần mềm. Cách giới hạn này khá giống với mô hình mà Anthropic đang áp dụng cho Mythos 5.1 thông qua hai chương trình Cyber Verification Program và Life Sciences Verification Program được công bố chỉ một ngày trước đó: bản phổ thông được siết chặt an toàn, còn bản mạnh hơn chỉ cấp cho các tổ chức được duyệt riêng.
Trên CyberGym, benchmark chuẩn ngành về phát hiện lỗ hổng tự động, Gemini 3.8 Flash Cyber vượt qua cả bản 3.5 Flash Cyber lẫn các model đầu bảng lớn hơn. Trên bộ kiểm tra nội bộ trải rộng 20 ngôn ngữ lập trình, tỷ lệ phát hiện lỗ hổng thành công vượt mức 70%. Trên CWE-Bench, benchmark vá lỗi độc lập do Collinear vận hành, model đạt pass@1 47,2%, gần bằng model đầu bảng dẫn đầu với 47,8% nhưng với chi phí thấp hơn hẳn. Google dẫn chứng ba con số thực tế: đội Chrome Security tạo ra lượng bản vá đúng nhiều gấp 2,6 lần so với các model thương mại lớn hơn; công ty an ninh mạng Wiz ghi nhận độ chính xác phát hiện cao hơn 7,5-9,7% với chi phí thấp hơn 2,3-5,2 lần so với các model đầu bảng khác; đội Cloud Vulnerability Research của Google tìm ra một lỗ hổng nền tảng nghiêm trọng trong chưa đầy 2 giờ, công việc thường mất nhiều tháng.
Kết quả của Gemini 3.8 Flash Cyber trên benchmark CyberGym so với các model khác.
Trước khi ra mắt chính thức, một số báo dẫn nguồn Wall Street Journal cho biết các kỹ sư Google từng thử nghiệm nội bộ model này (khi đó còn mang mật danh Skimaki) đối đầu với Claude Opus 5 của Anthropic trên nền tảng lập trình Jetski, và phần lớn đã chọn model mới của Google vì độ trễ thấp hơn và ít lỗi hơn. Tuy nhiên, bài công bố chính thức của Google không nhắc lại phép so sánh này.
Gemini 3.8 Flash đã có sẵn từ hôm nay cho các nhà phát triển thông qua Google Antigravity, Gemini API trên Google AI Studio, Android Studio và công cụ tạo giao diện Stitch; cho doanh nghiệp thông qua Gemini Enterprise Agent Platform; và cho thuê bao Google AI Pro, Ultra trong ứng dụng Gemini, chế độ AI Mode trên Google Search và Gemini trong Google Sheets. Gemini 3.8 Flash Cyber chỉ mở quyền truy cập khi đăng ký qua Fairwind Program.
Bài viết được AI dịch và tổng hợp tự động từ GenK AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.