← Về bảng nóng
SỰ KIỆNĐã lắng xuống

Qwen ra mắt mô hình phiên dịch trực tiếp Qwen3.8-LiveTranslate, giảm độ trễ LAAL xuống còn 2,3 giây

Tổng quan sự kiện

Toàn cảnh do AI tổng thuật

Alibaba Qwen vừa công bố mô hình ngôn ngữ lớn chuyên về phiên dịch trực tiếp Qwen3.8-LiveTranslate, tái cấu trúc quy trình phiên dịch thời gian thực bằng kiến trúc Interleave. Theo blog chính thức và báo cáo từ IT, mô hình này cải thiện toàn diện về độ chính xác, độ trôi chảy và tính súc tích, với độ trễ trung bình trên mỗi từ (LAAL) giảm từ 2,8 giây của thế hệ trước xuống còn 2,3 giây. Ngoài việc hỗ trợ 60 ngôn ngữ đầu vào, mô hình còn bổ sung ba khả năng mới: tách biệt người nói theo thời gian thực (xác định rõ người nói, tái tạo âm sắc ổn định hơn), xuất bản ngữ gốc và bản dịch cùng khung hình (hiển thị song ngữ trên cùng màn hình), và khử nhiễu ngữ cảnh dài (liên kết nội dung trước đó để dịch tên riêng và thuật ngữ chính xác hơn).

Về mặt kỹ thuật, IT đưa tin mô hình này sử dụng thiết kế hai mô-đun Thinker–Talker dựa trên Hybrid MoE, kết nối quá trình hiểu luồng, xuất văn bản và tạo giọng nói thông qua phương thức Interleave: Thinker sắp xếp video, âm thanh, văn bản gốc và bản dịch vào cùng một chuỗi nhân quả, được sắp xếp xen kẽ theo trình tự thời gian để tạo ra kết quả đầu cuối; Talker kết hợp bản dịch và âm thanh gốc để tổng hợp thành giọng nói dịch thuật vẫn giữ nguyên âm sắc của người nói ban đầu. Blog chính thức cho biết âm thanh và văn bản được đan xen thành một luồng âm-văn duy nhất, cho phép lưu trữ và tái sử dụng cả âm thanh đã nghe và văn bản đã dịch.

Về đánh giá, phía Qwen cho biết trên tập dữ liệu kiểm thử âm thanh dài đa người nói Omnilingua-MSpeaker bao phủ 14 hướng ngôn ngữ, mô hình này vượt trội hơn các hệ thống phiên dịch trực tiếp phổ biến hiện nay ở bốn khía cạnh: độ trung thực của bản dịch, độ trôi chảy, tính súc tích và tỷ lệ lỗi tách biệt người nói (DER). Trên tập kiểm thử âm thanh công khai FLEURS với 70 hướng ngôn ngữ, mô hình dẫn đầu thế hệ trước và các hệ thống hiện hành ở bốn tiêu chí: chất lượng dịch thuật, độ trễ trung bình trên mỗi từ, độ chính xác nhận dạng giọng nói và chất lượng tổng hợp giọng nói. Các kết quả đánh giá trên đều dựa trên công bố từ phía nhà phát triển.

Về khả năng sử dụng, blog chính thức cho biết mô hình được cung cấp thông qua DashScope API, đồng thời cung cấp ví dụ mẫu về ứng dụng khách phiên dịch trực tiếp: thu âm từ micro, truyền phát trực tuyến đến máy chủ và nhận/phát bản dịch. Các khả năng mới như tách biệt người nói và xuất đồng bộ văn bản gốc-bản dịch đều được kích hoạt thông qua cấu hình phiên làm việc; máy chủ sẽ trả về định danh người nói và văn bản gốc cùng lúc với bản dịch, loại bỏ nhu cầu gọi riêng biệt giao diện ASR. IT cũng cung cấp địa chỉ trải nghiệm thử nghiệm và địa chỉ API của mô hình.

Tổng thuật do AI tổng hợp từ toàn bộ bài đưa tin, cập nhật theo diễn biến · làm mới T7 · 19/09 · 14:56.

Diễn biến mới nhất

Xem chi tiết toàn cảnh sự việc tại đây.

Chính chủ · 2 bài

Nghe trực tiếp từ bên liên quan

Lọc toàn bộ bài chính chủ trong dòng thời gian →

Dòng thời gian đưa tin

Đang hiện 3 bài · tất cả · mới trước

T7 · 19/09

  1. Qwen ra mắt mô hình phiên dịch trực tiếp Qwen3.8-LiveTranslate

    X: Tongyi Qwen / Qwen (@Alibaba_Qwen)Chính chủ

    Qwen ra mắt thế hệ mô hình phiên dịch trực tiếp mới Qwen3.8-LiveTranslate, dựa trên kiến trúc Interleave, giúp giảm độ trễ trung bình (LAAL) từ 2,8 giây xuống 2,3 giây trên 60 ngôn ngữ, đồng thời cải thiện độ trung thực, độ trôi chảy và tính súc tích.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  2. Alibaba Qwen ra mắt mô hình ngôn ngữ lớn phiên dịch trực tiếp Qwen3.8-LiveTranslate, hỗ trợ xuất văn bản gốc và bản dịch cùng khung hình

    IT Home

    Alibaba Qwen ra mắt mô hình ngôn ngữ lớn phiên dịch trực tiếp Qwen3.8-LiveTranslate, sử dụng thiết kế hai mô-đun Thinker–Talker dựa trên Hybrid MoE, tái cấu trúc phiên dịch trực tiếp bằng kiến trúc Interleave, giảm độ trễ trung bình (LAAL) từ 2,8 giây xuống 2,3 giây.

    Đọc bản tiếng Việt →Đọc bài gốc ↗

T6 · 18/09

  1. Qwen ra mắt mô hình phiên dịch trực tiếp Qwen3.8-LiveTranslate, giảm độ trễ LAAL xuống còn 2,3 giây

    Qwen: Blog Retrieval (API)Chính chủ

    Qwen ra mắt Qwen3.8-LiveTranslate, sử dụng kiến trúc Interleave và thiết kế Hybrid-MoE Thinker–Talker để tái cấu trúc phiên dịch trực tiếp, giảm độ trễ trung bình (LAAL) từ 2,8 giây của thế hệ trước xuống 2,3 giây.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
← Về bảng nóng

Hồ sơ sự kiện được gom từ nhiều nguồn đưa tin độc lập rồi dịch, tóm tắt sang tiếng Việt. Bản quyền từng bài viết thuộc về cơ quan báo chí gốc. Nguồn dữ liệu: hồ sơ gốc trên AI HOT

Qwen ra mắt mô hình phiên dịch trực tiếp Qwen3.8-LiveTranslate, giảm độ trễ LAAL xuống còn 2,3 giây — Hồ sơ sự kiện | AIHOT.vn