The Decoder: AI News
85

Mô hình

Google ra mắt Gemini 3.8 Flash: Mẫu mô hình giá rẻ thứ ba chỉ trong sáu tuần

(giờ Việt Nam)

Tóm tắt AI

Google vừa giới thiệu Gemini 3.8 Flash, bao gồm phiên bản tiêu chuẩn và phiên bản chuyên dụng cho an ninh mạng (Cyber), đánh dấu bước đi chiến lược trong việc phổ cập các mô hình AI hiệu năng cao.

Bản dịch AI

Gemini 3.8 Flash is Google's third budget model in six weeks while frontier models remain MIA

Ba tuần sau khi ra mắt Gemini 3.7 Flash, Google đã trở lại với Gemini 3.8 Flash. Mẫu mô hình giá rẻ này được kỳ vọng sẽ vượt xa người tiền nhiệm về khả năng lập trình.

Google đang phát hành Gemini 3.8 Flash với hai phiên bản: một mô hình suy luận và lập trình đa năng, và một phiên bản chuyên dụng cho an ninh mạng có tên là 3.8 Flash Cyber. Đây là bản phát hành Flash thứ ba chỉ trong vòng sáu tuần, và việc liệu tốc độ nhanh chóng này là dấu hiệu của sức mạnh hay chỉ là sự xao nhãng khỏi các mô hình tiên phong vẫn còn thiếu vắng như Gemini 3.5 Pro và Gemini 4 hay không thì tùy thuộc vào quan điểm của mỗi người. Tân giám đốc Deepmind, Koray Kavukcuoglu, đã khẳng định rõ ràng rằng Google không chỉ theo đuổi việc tối ưu hóa giá thành trên hiệu năng mà vẫn muốn dẫn đầu về năng lực thuần túy.

Theo số liệu của chính Google, Gemini 3.8 Flash đạt 73,7% trên điểm chuẩn DeepSWE v1.1 dành cho các tác vụ kỹ thuật phần mềm dài hạn. Con số này chỉ thấp hơn một chút so với Claude Opus 5 (74,0%) nhưng vượt xa Claude Sonnet 5 (53,8%), GPT-5.6 Sol (72,7%) và phiên bản 3.7 Flash trước đó (65,3%).

Google cũng cho biết mô hình mới đã cải thiện khả năng tạo hình 3D. Video dưới đây cho thấy một trò chơi 3D mà Gemini 3.8 Flash được cho là đã xây dựng từ một câu lệnh duy nhất trong công cụ lập trình AI Antigravity của Google. Các kết cấu (textures) được tạo ra bằng mô hình hình ảnh Nano Banana của Google.

Gemini 3.8 Flash ra mắt với mức giá giảm còn 0,75 USD cho mỗi triệu token đầu vào và 3,75 USD cho mỗi triệu token đầu ra, tương đương với 3.7 Flash. Bắt đầu từ tháng 1 năm 2027, giá thông thường sẽ tăng lên 1,50 USD và 7,50 USD. Claude Opus 5 có giá 5,00 USD cho mỗi triệu token đầu vào và 25,00 USD cho token đầu ra, trong khi GPT-5.6 Sol có giá lần lượt là 4,00 USD và 20,00 USD. Ngay cả sau khi giá ưu đãi kết thúc, Gemini 3.8 Flash vẫn sẽ rẻ hơn nhiều trên mỗi token so với các mô hình hàng đầu từ OpenAI và Anthropic.

Tuy nhiên, Google giải thích rằng hiệu suất vượt trội so với 3.7 một phần là do 3.8 Flash thực hiện thêm các bước suy luận trên các tác vụ phức tạp và gọi công cụ một cách lặp đi lặp lại. Google cho biết mô hình này "làm việc chăm chỉ hơn", đồng nghĩa với việc tiêu thụ token cao hơn, điều này bù đắp một phần cho mức giá thấp trên mỗi token. Đối với các trường hợp sử dụng mà hiệu quả tính toán là quan trọng nhất, Google khuyến nghị nên sử dụng các cấp độ suy luận thấp hơn hoặc tiếp tục sử dụng phiên bản 3.7 Flash vẫn đang được hỗ trợ.

Gemini 3.8 Flash hiện đã có sẵn cho các nhà phát triển thông qua Google AI Studio, Google Antigravity và Android Studio. Các doanh nghiệp có thể truy cập thông qua Gemini Enterprise. Người tiêu dùng có thể sử dụng trong ứng dụng Gemini, trong chế độ AI Mode của Google Search và đối với người đăng ký trả phí, là trong Google Sheets.

Hiệu quả chi phí cao, nhưng chi phí token sẽ tăng dần

Nền tảng đánh giá độc lập Artificial Analysis chấm cho Gemini 3.8 Flash điểm Intelligence Index là 59, cao hơn ba điểm so với người tiền nhiệm 3.7 Flash (56 điểm). Điều này đưa nó ngang hàng với GPT-5.6 Sol ở mức suy luận cao (high reasoning) và Grok 4.6 ở mức suy luận trung bình (medium reasoning), cả hai đều đạt 59 điểm. Theo Artificial Analysis, mức tăng điểm Intelligence Index chủ yếu đến từ hiệu suất mạnh mẽ hơn trên các điểm chuẩn tác nhân (agentic benchmarks) như sử dụng công cụ và các tác vụ lập trình.

Về chi phí trên mỗi tác vụ, 3.8 Flash đạt đến đường biên Pareto theo Artificial Analysis, với mức 0,58 USD mỗi tác vụ, trở thành mô hình rẻ nhất ở cấp độ thông minh của nó. Tuy nhiên, con số đó đã tăng khoảng 40% so với 3.7 Flash (0,40 USD), mặc dù giá mỗi token vẫn giữ nguyên. Đó có lẽ là lý do tại sao Google khuyến nghị nên gắn bó với 3.7 Flash cho các khối lượng công việc tập trung vào hiệu suất.

Ở các cấp độ suy luận cao, 3.8 Flash tạo ra khoảng 300 token đầu ra mỗi giây với thời gian trung bình cho mỗi tác vụ là 2,5 phút. Tốc độ này nhanh hơn một chút so với GPT-5.6 Luna (2,6 phút) và GPT-5.6 Terra (3,3 phút) nhưng chậm hơn Claude Fable 5.1 (2,1 phút) và phiên bản 3.7 Flash cũ hơn (2,2 phút). Ở các cấp độ suy luận thấp, thời gian giảm xuống còn khoảng 48 giây.

Mô hình an ninh mạng vẫn được kiểm soát chặt chẽ cho các bên phòng thủ đã qua kiểm duyệt

Gemini 3.8 Flash Cyber, giống như người tiền nhiệm 3.5 Flash Cyber, không được phát hành công khai. Google phân phối nó thông qua Chương trình Fairwind cho các cơ quan chính phủ, các nhà vận hành cơ sở hạ tầng trọng yếu và những người bảo trì phần mềm. Mô hình này có các thiết lập an toàn ít hạn chế hơn so với phiên bản tiêu chuẩn vì nó được xây dựng cho công việc an ninh mạng phòng thủ.

Trên CyberGym, điểm chuẩn tiêu chuẩn ngành để phát hiện lỗ hổng trong C/C++, 3.8 Flash Cyber đạt 86,2% theo Google, vượt qua phiên bản 3.5 Flash Cyber trước đó (77,5%), GPT-5.6 Sol (83,6%) và GPT-5.5-Cyber (85,6%). Đối với việc vá lỗi tự động trên CWE-Bench bên ngoài, 3.8 Flash Cyber đạt 47,2% Pass@1, gần như ngang bằng với mô hình tiên phong hàng đầu (47,8%) trong khi chi phí thấp hơn nhiều.

Mô hình này cũng tỏ ra kiên cường hơn trước các cuộc tấn công tiêm câu lệnh (prompt injection). Trên điểm chuẩn Gray Swan IPI, Gemini 3.8 Flash đạt tỷ lệ tấn công thành công chỉ 5,5%. DeepSeek V4 Pro đạt 60,1%, Kimi K3 đạt 52,7% và Grok 4.6 đạt 51,8%. Chỉ có Claude Opus 5 của Anthropic làm tốt hơn một chút ở mức 4,8%, và Opus 5 với các tùy chọn bảo mật bổ sung còn đạt điểm thấp hơn nữa trong hệ sinh thái Claude.

Tin tức AI không cường điệu – Được tuyển chọn bởi con người

Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo tiên phong "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và quyền truy cập vào phần bình luận của chúng tôi.

Đăng ký ngay

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.