CafeF Kinh tế số
85

Mô hình

Google tung Gemini 1.5 Flash-8B: Cuộc đua tốc độ trước áp lực từ Anthropic

(giờ Việt Nam)

Tóm tắt AI

Google tiếp tục cập nhật dòng Flash lần thứ ba chỉ trong 6 tuần, động thái này diễn ra ngay khi Anthropic vừa nâng cấp toàn diện các mô hình chủ lực của họ.

Bản dịch AI

Bản cập nhật Flash thứ ba trong 6 tuần của Google xuất hiện đúng lúc Anthropic vừa nâng cấp toàn bộ dòng model hàng đầu của họ.

Ngày 2/9, Google ra mắt Gemini 3.8 Flash và biến thể an ninh mạng Gemini 3.8 Flash Cyber, chỉ một ngày sau khi Anthropic tung ra Claude Fable 5.1 và Mythos 5.1. Tuy nhiên, trong khi Anthropic nâng cấp trực tiếp vào dòng model mạnh nhất, Google lại tiếp tục tung ra một bản Flash – phân khúc tầm trung giá rẻ – thay vì Gemini 3.5 Pro, model đầu bảng mà giới công nghệ đã chờ đợi suốt nhiều tháng qua.

Google ra Gemini 3.8 Flash, vẫn chưa thấy bản Pro đâu- Ảnh 1.

Google công bố Gemini 3.8 Flash và 3.8 Flash Cyber trên blog chính thức.

Đây đã là bản Flash thứ ba Google ra mắt chỉ trong 6 tuần, sau Gemini 3.6 Flash ngày 21/7 và Gemini 3.7 Flash ngày 13/8. Trong khi đó, Gemini 3.5 Pro, model đầu bảng thực sự của hãng, vẫn chưa có ngày ra mắt cụ thể, dù CEO Sundar Pichai từng chia sẻ hồi tháng 7 rằng model này đang được thử nghiệm cùng các đối tác. Đầu tháng 8, Google cũng thay đổi nhân sự cấp cao tại DeepMind: Demis Hassabis rời vị trí điều hành hàng ngày để giữ vai trò Chủ tịch, còn Koray Kavukcuoglu, cựu Giám đốc công nghệ DeepMind, tiếp quản việc phát triển Gemini và báo cáo trực tiếp cho Sundar Pichai.

Về giá cả, Gemini 3.8 Flash giữ nguyên mức giới thiệu của bản 3.7 Flash: 0,75 USD cho mỗi triệu token đầu vào và 3,75 USD cho mỗi triệu token đầu ra (tương đương khoảng 19.700 đồng và 98.600 đồng), áp dụng đến hết năm 2026. Từ ngày 1/1/2027, giá sẽ tăng lên 1,50 USD và 7,50 USD (tương đương khoảng 39.400 đồng và 197.000 đồng).

Google cho biết Gemini 3.8 Flash vượt qua phần lớn các model đầu bảng lớn hơn trên DeepSWE v1.1 – benchmark đo khả năng tự giải quyết các bài toán kỹ thuật phần mềm phức tạp – dù chi phí thấp hơn nhiều. Model này cũng dẫn trước cả Gemini 3.7 Flash lẫn các model đầu bảng khác trên hai benchmark chuyên ngành là Vals Finance Agent V2 và Harvey Legal Agent Benchmark, đồng thời đạt 54,9% trên HLE-Verified, bài kiểm tra suy luận nhiều bước trải rộng trên các lĩnh vực khoa học, nhân văn và chuyên môn. Cách model đạt điểm cao là "làm việc chăm chỉ hơn": tự thêm các bước suy luận, gọi công cụ nhiều lần hơn, điều này có thể tốn nhiều token hơn khi thiết lập mức effort cao. Google khuyên người dùng nên hạ mức effort nếu ưu tiên tiết kiệm chi phí, hoặc tiếp tục sử dụng Gemini 3.7 Flash cho các tác vụ cần tối ưu hóa token.

Google ra Gemini 3.8 Flash, vẫn chưa thấy bản Pro đâu- Ảnh 2.

Bảng so sánh hiệu năng Gemini 3.8 Flash với các model đầu bảng khác.

Để trình diễn năng lực, Google đã để Gemini 3.8 Flash tự dựng một game 3D hoàn chỉnh (nhân vật phù thủy khám phá lâu đài) chỉ từ một câu lệnh trong công cụ lập trình Google Antigravity, sử dụng texture tạo bởi Nano Banana. Model cũng dựng được bản Google Maps giao diện DOS có thể chơi được, bao gồm tính năng chỉ đường và Street View, cũng chỉ từ một câu lệnh, kết hợp với một công cụ trực quan hóa địa hình 3D sử dụng dữ liệu thực từ Cơ quan Khảo sát Địa chất Mỹ.

Đáng chú ý nhất là cách Google xử lý Gemini 3.8 Flash Cyber. Bản này chỉ mở cho "bên phòng thủ đáng tin cậy" thông qua chương trình mới mang tên Fairwind, bao gồm các cơ quan chính phủ, đơn vị vận hành hạ tầng trọng yếu và nhà bảo trì phần mềm. Cách giới hạn này khá giống với mô hình Anthropic đang áp dụng cho Mythos 5.1 thông qua hai chương trình Cyber Verification Program và Life Sciences Verification Program được công bố chỉ một ngày trước đó: bản phổ thông siết chặt an toàn, còn bản mạnh hơn chỉ cấp cho các tổ chức được duyệt riêng.

Trên CyberGym, benchmark chuẩn ngành về phát hiện lỗ hổng tự động, Gemini 3.8 Flash Cyber vượt qua cả bản 3.5 Flash Cyber lẫn các model đầu bảng lớn hơn. Trên bộ kiểm tra nội bộ trải rộng 20 ngôn ngữ lập trình, tỷ lệ phát hiện lỗ hổng thành công vượt mức 70%. Trên CWE-Bench, benchmark vá lỗi độc lập do Collinear vận hành, model đạt pass@1 là 47,2%, gần bằng model đầu bảng dẫn đầu với 47,8% nhưng với chi phí thấp hơn hẳn. Google dẫn ra ba con số thực tế: đội Chrome Security tạo ra lượng bản vá đúng nhiều gấp 2,6 lần so với các model thương mại lớn hơn; công ty an ninh mạng Wiz ghi nhận độ chính xác phát hiện cao hơn 7,5-9,7% với chi phí thấp hơn 2,3-5,2 lần so với các model đầu bảng khác; đội Cloud Vulnerability Research của Google tìm ra một lỗ hổng nền tảng nghiêm trọng trong chưa đầy 2 giờ, công việc thường mất nhiều tháng.

Google ra Gemini 3.8 Flash, vẫn chưa thấy bản Pro đâu- Ảnh 3.

Kết quả Gemini 3.8 Flash Cyber trên benchmark CyberGym so với các model khác.

Trước khi ra mắt chính thức, một số báo dẫn nguồn Wall Street Journal cho biết các kỹ sư Google từng thử nghiệm nội bộ model này (khi đó còn mang mật danh Skimaki) đối đầu với Claude Opus 5 của Anthropic trên nền tảng lập trình Jetski, và phần lớn đã chọn model mới của Google vì độ trễ thấp hơn và ít lỗi hơn. Tuy nhiên, bài công bố chính thức của Google không nhắc lại phép so sánh này.

Gemini 3.8 Flash có sẵn ngay từ hôm nay cho các nhà phát triển thông qua Google Antigravity, Gemini API trên Google AI Studio, Android Studio và công cụ tạo giao diện Stitch; cho doanh nghiệp thông qua Gemini Enterprise Agent Platform; và cho thuê bao Google AI Pro, Ultra trong ứng dụng Gemini, chế độ AI Mode trên Google Search và Gemini trong Google Sheets. Gemini 3.8 Flash Cyber chỉ mở quyền truy cập khi đăng ký qua Fairwind Program.

GoogleGeminiAIAnthropicCông nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ CafeF Kinh tế số. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.