23/09

Thứ Tư · 3 tin
The Decoder: AI News
Sản phẩmĐiểm AI 67/100

Alibaba ra mắt Qwen-Audio-3.1 với 5 mô hình mới, giảm giá dịch vụ AI âm thanh tới 95%

Alibaba giới thiệu bộ 5 mô hình Qwen-Audio-3.1 chuyên về nhận diện (ASR) và tổng hợp giọng nói (TTS) với khả năng xử lý đa ngôn ngữ, cảm xúc và âm thanh môi trường vượt trội, đồng thời cắt giảm mạnh chi phí API lên đến 95%.

Thêm 2 nguồn khác đưa tinPandailyIT Home
Qwen@Alibaba_Qwen
Mô hìnhĐiểm AI 67/100

Tinh chọnQwen ra mắt hệ sinh thái Qwen-Audio-3.1: Nâng cấp toàn diện ASR, TTS và Realtime

⚡ Meet Qwen-Audio-3.1! ASR, TTS & Realtime are fully upgraded, joined by two new models: TTS-Next fo…

DịchQwen giới thiệu Qwen-Audio-3.1 với 5 mô hình mới, bổ sung TTS-Next và ASR-Next cùng khả năng tương tác thời gian thực thông minh. Đặc biệt, chi phí sử dụng được cắt giảm mạnh tới 95%, hỗ trợ nhận diện cảm xúc và phản hồi tự nhiên hơn.


Vì sao đáng đọc: Nhà phát hành công bố chi tiết năng lực của năm mô hình âm thanh cùng ba mức giảm giá, giúp độc giả đối chiếu với nhu cầu thực tế để đánh giá chi phí thay thế.
IT Home
Mô hìnhĐiểm AI 68/100

Cùng sự kiệnAlibaba ra mắt dòng mô hình âm thanh Qwen-Audio-3.1 và giảm giá toàn bộ sản phẩm

Alibaba vừa giới thiệu 5 mô hình thuộc dòng Qwen-Audio-3.1 bao gồm ASR, ASR-Next, TTS, TTS-Next và Realtime, hỗ trợ toàn diện từ nhận diện, tổng hợp giọng nói đến tương tác thời gian thực.

Cùng sự kiện, bài đại diện «Alibaba ra mắt Qwen-Audio-3.1 với 5 mô hình mới, giảm giá dịch vụ AI âm thanh tới 95%»

21/09

Thứ Hai · 1 tin

16/09

Thứ Tư · 3 tin
StepFun@StepFun_ai
Mô hìnhĐiểm AI 64/100

Cùng sự kiệnStepFun ra mắt dòng StepAudio 3: Đột phá với 5 mô hình âm thanh toàn diện

Introducing StepAudio 3, our new family of 5 audio models for real-time voice, speech recognition, s…

DịchStepFun vừa trình làng bộ 5 mô hình StepAudio 3, dẫn đầu bảng xếp hạng Artificial Analysis về khả năng hội thoại và suy luận giọng nói, đồng thời đạt tỷ lệ lỗi nhận diện (ASR) cực thấp chỉ 1,7%.

Cùng sự kiện, tinh chọn hiển thị «StepAI ra mắt dòng mô hình âm thanh StepAudio 3: Thống trị bảng xếp hạng toàn cầu của Artificial Analysis»
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 67/100

Cùng sự kiệnGoogle ra mắt bộ đôi mô hình âm thanh Gemini 3.8 Live và Extended Thinking

GOOGLE 🔥: Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking are rolling out on APIs, Google AI …

DịchGoogle vừa trình làng Gemini 3.8 Live cùng phiên bản Extended Thinking, hỗ trợ xử lý âm thanh chuyên sâu và hiện đã có mặt trên API, Google AI Studio và ứng dụng Gemini Live.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.8 Live và bản Extended Thinking: Đột phá mới cho trợ lý giọng nói»
Google AI@GoogleAI
Mô hìnhĐiểm AI 63/100

Cùng sự kiệnGoogle ra mắt Gemini 3.8 Live và 3.8 Live Extended Thinking: Bước tiến mới cho mô hình âm thanh

Introducing our most advanced Gemini Audio models yet 🗣 Gemini 3.8 Live and 3.8 Live Extended Thin…

DịchGoogle vừa giới thiệu Gemini 3.8 Live và 3.8 Live Extended Thinking, những mô hình âm thanh tiên tiến nhất của hãng với khả năng xử lý tư duy mở rộng.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.8 Live và bản Extended Thinking: Đột phá mới cho trợ lý giọng nói»

15/09

Thứ Ba · 1 tin
IT Home
Mô hìnhĐiểm AI 61/100

Cùng sự kiệnStepStar ra mắt dòng mô hình âm thanh StepAudio 3: Đa năng từ Realtime đến tạo nhạc

StepStar vừa trình làng bộ 5 mô hình StepAudio 3 bao gồm Realtime, ASR, TTS, Gen và Music, hiện đã chính thức có mặt trên nền tảng mở của hãng.

Cùng sự kiện, tinh chọn hiển thị «StepAI ra mắt dòng mô hình âm thanh StepAudio 3: Thống trị bảng xếp hạng toàn cầu của Artificial Analysis»

14/09

Thứ Hai · 1 tin

09/09

Thứ Tư · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 48/100

AuK: Mô hình nền tảng mã nguồn mở đột phá trong tạo và chỉnh sửa giọng nói

AuK là mô hình nền tảng đa năng cho phép tạo và chỉnh sửa giọng nói thông qua ngôn ngữ tự nhiên, được huấn luyện trên quy mô dữ liệu khổng lồ. Phiên bản AuK-Flash tối ưu hóa tốc độ suy luận nhanh gấp 4.5 lần, mở ra tiềm năng ứng dụng lớn cho các nhà phát triển.

21/08

Thứ Sáu · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 52/100

NAPE: Bước tiến mới trong học tự giám sát cho âm thanh với dự đoán nhúng

NAPE là khung học tự giám sát tối giản sử dụng Transformer nhân quả để dự đoán các đoạn âm thanh tiếp theo mà không cần bộ giải mã phức tạp. Phương pháp này đạt hiệu suất vượt trội trên nhiều tác vụ âm thanh và giọng nói, đồng thời có khả năng mở rộng quy mô ấn tượng.

18/08

Thứ Ba · 1 tin
Tổng 12 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (27 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI âm thanh” | AIHOT.vn