Mô hình
Google ra mắt Gemini 3.8 Live: Đối thủ cạnh tranh trực tiếp với GPT-Live-1 của OpenAI
(giờ Việt Nam)
Tóm tắt AI
Google DeepMind vừa giới thiệu hai mô hình giọng nói mới là Gemini 3.8 Live và 3.8 Live Extended Thinking, mang đến giải pháp thay thế hiệu quả với chi phí tối ưu hơn so với GPT-Live-1.
Bản dịch AI

15 tháng 9, 2026
Google Deepmind đã ra mắt Gemini 3.8 Live và 3.8 Live Extended Thinking, hai mô hình âm thanh mới dành cho các nhà phát triển, hiện đã có sẵn thông qua Gemini API và Google AI Studio. Gemini 3.8 Live hỗ trợ các tác nhân giọng nói có khả năng thực hiện lệnh gọi API ở chế độ nền, xử lý đầu vào hình ảnh và duy trì hội thoại cùng lúc. Mô hình này hỗ trợ hơn 97 ngôn ngữ. Biến thể Extended Thinking hiện đang đứng đầu bảng xếp hạng Artificial Analysis Speech-to-Speech với 82,6%, vượt qua các mô hình GPT-Live-1 mới nhất của OpenAI. Các ứng dụng mẫu hiện đã có trên GitHub.
Google tính phí 0,005 USD mỗi phút cho đầu vào âm thanh và 0,018 USD cho đầu ra, rẻ hơn nhiều so với mức 0,05 USD mỗi phút của GPT-Live-1 từ OpenAI. Một giờ hội thoại bằng giọng nói có chi phí khoảng 1,38 USD với Google, so với ít nhất 3,00 USD với OpenAI. Mô hình của OpenAI vẫn mang lại các cuộc hội thoại tự nhiên hơn nhờ tính năng full duplex cho phép nghe và nói cùng một lúc. Dựa trên các bản demo, âm thanh của OpenAI cũng nghe tốt hơn, cho thấy Google một lần nữa ưu tiên tối ưu hóa về giá hơn là chất lượng.
Tin tức AI không thổi phồng – Được biên soạn bởi con người
Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.
Đăng ký ngay
Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.