Mô hình
Alibaba ra mắt dòng mô hình âm thanh Qwen-Audio-3.0, dẫn đầu 3 bảng xếp hạng toàn cầu
(giờ Việt Nam)
Tóm tắt AI
Alibaba chính thức đưa Qwen-Audio-3.0 lên nền tảng Qwen và Bailian. Dòng mô hình này bao gồm ASR, TTS và tương tác thời gian thực, hiện đang giữ vị trí số 1 thế giới trên bảng xếp hạng Artificial Analysis.
Bản dịch AI
Theo tin từ IT ngày 17 tháng 8, chiều nay (17/8), Alibaba Cloud thông báo trên tài khoản chính thức rằng dòng mô hình giọng nói Qwen-Audio-3.0 đã chính thức ra mắt trên nền tảng Qwen AI và nền tảng Alibaba Cloud Bailian. Các nhà phát triển có thể gọi khả năng của mô hình thông qua dịch vụ API hoặc đăng ký Token Plan để sử dụng.

Dòng mô hình Qwen-Audio-3.0 là mô hình giọng nói tự nghiên cứu do Alibaba phát triển. IT xin liệt kê danh mục sản phẩm cụ thể như sau:
Mô hình lớn nhận dạng giọng nói Qwen-Audio-3.0-ASR
Mô hình lớn tổng hợp giọng nói Qwen-Audio-3.0-TTS
Mô hình đối thoại tương tác giọng nói thời gian thực Qwen-Audio-3.0-Realtime
Theo giới thiệu, trên bảng xếp hạng giọng nói tháng 7 năm nay của Artificial Analysis - nền tảng đánh giá AI uy tín toàn cầu, mô hình này đã giành vị trí số 1 thế giới ở cả ba hạng mục: nhận dạng giọng nói (ASR), tương tác thời gian thực (RealTime) và tổng hợp giọng nói (TTS), đạt thành tích "Grand Slam".
Trong đó, Qwen-Audio-3.0-ASR chuyển đổi giọng nói thành văn bản, hỗ trợ nhận dạng trong ngữ cảnh phức tạp và các lĩnh vực chuyên môn; Qwen-Audio-3.0-TTS chuyển đổi văn bản thành giọng nói, hỗ trợ đa ngôn ngữ, đa phương ngữ, có thể kiểm soát cảm xúc, tông giọng và nhịp điệu; Qwen-Audio-3.0-Realtime hỗ trợ hiểu và đối thoại giọng nói đầu cuối (end-to-end), có thể vừa nghe vừa nói, ngắt lời để đặt câu hỏi bất cứ lúc nào và hỗ trợ gọi công cụ.
Hiện tại, dòng mô hình này đã được ứng dụng trong các sản phẩm như ứng dụng Qwen, Qwen Office, Qoder, v.v.
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.