← Về bảng nóng
SỰ KIỆNĐã lắng xuống

Qwen ra mắt Qwen3.8-Omni-Flash, mô hình tác tử toàn phương thức đầu tiên

Tổng quan sự kiện

Tóm tắt sự kiện · Thông tin xác thực

Qwen ra mắt Qwen3.8-Omni-Flash, khẳng định đây là mô hình đa phương thức đầu tiên được xây dựng xoay quanh khả năng của tác nhân (agent), hỗ trợ hiểu, suy luận và gọi công cụ bằng âm thanh, hình ảnh nguyên bản. Hãng cho biết khả năng xử lý âm thanh và video tiệm cận với Gemini 3.8 Flash, đồng thời cải thiện hiệu suất tác nhân trung bình 19,5 điểm trên WildClawBench-MM và UniClawBench. Cùng lúc đó, Qwen cũng mã nguồn mở Qwen-MM-Plugins và Qwen-Live Harness.

Theo bài gốc của sự kiện từ X: Alibaba Cloud (@alibaba_cloud).

Diễn biến mới nhất

Qwen ra mắt Qwen3.8-Omni-Flash, mô hình tác tử toàn phương thức đầu tiên.

Chính chủ · 2 bài

Nghe trực tiếp từ bên liên quan

Lọc toàn bộ bài chính chủ trong dòng thời gian →

Dòng thời gian đưa tin

Đang hiện 10 bài · tất cả · mới trước

T7 · 19/09

  1. Qwen công bố Qwen3.8-Omni-Flash: Giá thấp hơn Gemini Flash, hiệu năng đa phương thức được khẳng định tiệm cận đối thủ

    The Decoder: AI News

    Qwen ra mắt Qwen3.8-Omni-Flash, mô hình đa phương thức đầu tiên hướng tới tác tử AI. Giá API là 0,15 USD cho mỗi triệu token đầu vào và 0,47 USD cho đầu ra, thấp hơn Gemini 3.8 Flash. Theo Qwen, hiệu suất trên các tiêu chuẩn đánh giá đa phương thức của mô hình này tiệm cận với Gemini 3.8 Flash. Người dùng có thể truy cập mô hình qua Qwen Studio, Qwen Cloud và API, kèm theo các plugin mã nguồn mở.

    Đọc bản tiếng Việt →Đọc bài gốc ↗

T6 · 18/09

  1. Alibaba: Ra mắt Qwen3.8-Omni-Flash, mô hình tác tử toàn phương thức đầu tiên

    X: Testing Catalog (@testingcatalog)

    Alibaba ra mắt Qwen3.8-Omni-Flash, khẳng định đây là mô hình tác tử toàn phương thức đầu tiên, hỗ trợ cửa sổ ngữ cảnh 1 triệu token, xử lý âm thanh, video và công cụ nguyên bản, đồng thời giảm khoảng 89% chi phí đầu vào video so với bản 3.5-Omni-Plus.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  2. Qwen của Alibaba ra mắt Qwen3.8-Omni-Flash: Mô hình toàn phương thức đầu tiên được xây dựng xoay quanh khả năng tác tử, đã có sẵn dưới dạng API nhưng chưa công bố mở mã nguồn tại thời điểm ra mắt

    MarkTechPost

    Đội ngũ Qwen phát hành Qwen3.8-Omni-Flash, mô hình toàn phương thức đầu tiên được tối ưu cho khả năng tác tử, hỗ trợ đầu vào văn bản, hình ảnh, âm thanh, video và trả về văn bản với cửa sổ ngữ cảnh 1 triệu token. Mô hình hiện đã có sẵn trên QwenCloud, Alibaba Cloud Model Studio và Qwen Studio dưới dạng API. Tại thời điểm ra mắt, hãng chưa công bố mở trọng số, đồng nghĩa người dùng chưa thể tự lưu trữ. Các dữ liệu về hiệu năng và chi phí đều do Qwen tự công bố, chưa có kết quả kiểm chứng độc lập.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  3. Alibaba ra mắt mô hình toàn phương thức Qwen3.8-Omni-Flash, hỗ trợ hiểu âm thanh và video

    X: Testing Catalog (@testingcatalog)

    Alibaba ra mắt Qwen3.8-Omni-Flash, mô hình toàn phương thức có khả năng hiểu âm thanh và video, sở hữu cửa sổ ngữ cảnh 1 triệu token, với hiệu suất trên WildClawBench-MM và UniClawBench tiệm cận Gemini 3.8 Flash.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  4. Alibaba ra mắt mô hình đa phương thức toàn diện Qwen3.8-Omni-Flash, đồng thời mã nguồn mở Qwen-Live Harness và các tiện ích mở rộng Qwen-MM-Plugins

    Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)

    Alibaba chính thức công bố thế hệ mô hình đa phương thức nguyên bản tiếp theo là Qwen3.8-Omni-Flash cùng phiên bản thời gian thực Qwen3.8-Omni-Flash-Realtime. Mô hình hiện đã cung cấp API trên nền tảng Qwen AI, hỗ trợ cửa sổ ngữ cảnh 1M token. Đồng thời, hãng cũng mã nguồn mở môi trường thực thi tương tác thời gian thực Qwen-Live Harness và các tiện ích mở rộng Qwen-MM-Plugins (bao gồm Video2Note và Omni Skill Creator).

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  5. Qwen ra mắt Qwen3.8-Omni-Flash, mô hình tác tử toàn phương thức đầu tiên

    X: Alibaba Cloud (@alibaba_cloud)Chính chủ

    Qwen ra mắt Qwen3.8-Omni-Flash, khẳng định đây là mô hình đa phương thức đầu tiên được xây dựng xoay quanh khả năng của tác nhân (agent), hỗ trợ hiểu, suy luận và gọi công cụ bằng âm thanh, hình ảnh nguyên bản. Hãng cho biết khả năng xử lý âm thanh và video tiệm cận với Gemini 3.8 Flash, đồng thời cải thiện hiệu suất tác nhân trung bình 19,5 điểm trên WildClawBench-MM và UniClawBench. Cùng lúc đó, Qwen cũng mã nguồn mở Qwen-MM-Plugins và Qwen-Live Harness.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  6. Alibaba Qwen ra mắt mô hình đa phương thức Qwen3.8-Omni-Flash, hỗ trợ ngữ cảnh 1M token và giới thiệu phiên bản thời gian thực

    IT Home

    Ngày 18/9, Alibaba Qwen đã ra mắt thế hệ mô hình đa phương thức nguyên bản mới Qwen3.8-Omni-Flash, có khả năng xử lý đồng thời đầu vào văn bản, hình ảnh, âm thanh và video, hỗ trợ ngữ cảnh 1M token và đã có mặt trên nền tảng Qwen AI. Bên cạnh đó, phiên bản thời gian thực Qwen3.8-Omni-Flash-Realtime cũng được giới thiệu, được hãng gọi là mô hình đa phương thức lớn đầu tiên hỗ trợ khả năng "định vị âm thanh".

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  7. Qwen ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức đầu tiên lấy khả năng của tác nhân làm cốt lõi, đồng thời mã nguồn mở Qwen-MM-Plugins

    X: Tongyi Qwen / Qwen (@Alibaba_Qwen)Chính chủ

    Qwen ra mắt Qwen3.8-Omni-Flash với khả năng hiểu, suy luận và sử dụng công cụ bằng âm thanh, video nguyên bản. Theo công bố, hiệu suất tác nhân của mô hình tăng trung bình 19,5 điểm so với chuẩn, tiệm cận với Gemini 3.8 Flash, hỗ trợ ngữ cảnh 1M token, đồng thời chi phí đầu vào video giảm khoảng 89% so với Qwen3.5-Omni-Plus. Ngoài ra, Qwen-MM-Plugins đã được mã nguồn mở và Qwen-Live Harness sắp sửa ra mắt.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  8. Qwen phát hành Qwen3.8-Omni-Flash cùng phiên bản Realtime, đồng thời giới thiệu hai khung hỗ trợ là Qwen-Live-Harness và Qwen-MM-Plugins

    X: karminski (@karminski3)

    Theo thông tin gốc, Qwen vừa phát hành Qwen3.8-Omni-Flash với điểm số khả năng tác nhân tăng trung bình 25% so với Qwen3.5-omni-flash. Tỷ lệ lỗi nhận diện giọng nói trong các cuộc họp có nhiều người nói chồng chéo giảm từ 88% xuống còn 3%. Mô hình hỗ trợ nguyên bản đầu vào âm thanh và video liên tục lên đến 1 giờ, giá đầu vào âm thanh giảm từ 18 nhân dân tệ xuống 0,8 nhân dân tệ cho mỗi triệu token. Ngoài ra, phiên bản Realtime có độ trễ cực thấp cũng được công bố (xử lý 20 giây âm thanh chỉ trong khoảng 981ms). Bộ công cụ hỗ trợ Qwen-Live-Harness cung cấp tính năng đối thoại qua bóng nổi và thông báo theo dõi tác vụ; Qwen-MM-Plugins cho phép cài đặt vào Claude Code, Gemini CLI, Codex, OpenClaw để gọi mô hình này theo phương thức đa phương thức, bao gồm cả omni-skill-creator giúp tạo kỹ năng điều khiển phần mềm thông qua việc ghi lại video thao tác (có thể kèm giải thích bằng giọng nói).

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  9. Đội ngũ Qwen của Alibaba phát hành thế hệ mô hình đa phương thức mới Qwen3.8-Omni-Flash

    Hacker News: AI bài nổi bật

    Đội ngũ Qwen hôm nay đã ra mắt Qwen3.8-Omni-Flash, mô hình đa phương thức nguyên bản được định vị nhằm tăng cường khả năng của tác nhân AI (AI agent). Mô hình này hiện đã mở trên nền tảng Qwen AI, hỗ trợ đầu vào dạng văn bản, hình ảnh, âm thanh, video cùng cửa sổ ngữ cảnh 1M token. Đồng thời, đội ngũ cũng giới thiệu phiên bản thời gian thực Qwen3.8-Omni-Flash-Realtime cùng các công cụ mã nguồn mở Qwen-MM-Plugins và Qwen-Live Harness. Theo thông tin chính thức, điểm trung bình qua 29 bài kiểm tra đánh giá đã tăng hơn 25% so với Qwen3.5-Omni-Plus, trong khi chi phí đầu vào âm thanh giảm hơn 98%.

    Đọc bài gốc ↗
← Về bảng nóng

Hồ sơ sự kiện được gom từ nhiều nguồn đưa tin độc lập rồi dịch, tóm tắt sang tiếng Việt. Bản quyền từng bài viết thuộc về cơ quan báo chí gốc. Nguồn dữ liệu: hồ sơ gốc trên AI HOT

Qwen ra mắt Qwen3.8-Omni-Flash, mô hình tác tử toàn phương thức đầu tiên — Hồ sơ sự kiện | AIHOT.vn