Jiqizhixin
85

Mô hình

Tencent ra mắt mô hình nhận diện giọng nói Hy ASR 3.0: Đột phá về hiểu ngữ cảnh và phương ngữ

(giờ Việt Nam)

Tóm tắt AI

Tencent vừa giới thiệu Hy ASR 3.0 preview, mô hình nhận diện giọng nói tích hợp khả năng hiểu ngữ cảnh sâu sắc từ LLM, giúp cải thiện độ chính xác trong các môi trường nhiễu, đa phương ngữ và thuật ngữ chuyên ngành.

Bản dịch AI

Sự kiện AI tháng 7 năm 2026

Đạt được sự cải thiện mang tính hệ thống về khả năng bao phủ đa ngôn ngữ, phương ngữ cũng như độ bền vững trong môi trường âm thanh phức tạp,... Alibaba ra mắt mô hình lớn nhận dạng giọng nói Qwen-Audio-3.0-ASR-Flash: Cốt lõi...

AI Honeypot của Lười Biếng Tiểu Mật Phong (Lazy Bee)

Xiaohongshu lại tiếp tục tung chiêu! Hệ thống giọng nói "4 trong 1" cấp công nghiệp FireRedASR2S gây bão, xử lý chính xác hơn 100 ngôn ngữ, hơn 20 phương ngữ và cả hát!

Bao phủ các lĩnh vực rộng hơn, phương ngữ và thậm chí là nhận dạng lời bài hát. Để đáp ứng các nhu cầu khác nhau... đã thực hiện đối chuẩn toàn diện với các mô hình như Fun-ASR, Whisper,... (Lưu ý: Kết quả API thương mại có thể...)

Một cốc Cola trò chuyện về AI

Tốc độ truy xuất tăng gấp tám lần, ByteDance ra mắt hệ thống truy xuất âm nhạc mới nhất ByteCover2

Được mệnh danh là công nghệ nhận dạng âm nhạc thế hệ tiếp theo. Nguồn | Machine (Synced). Gần đây, ByteDance Volcano... Trên cơ sở mô hình nhận dạng giọng nói được huấn luyện bằng tập dữ liệu ASR, phương pháp trong bài viết này trong các cuộc họp thực tế...

Ngôi nhà giọng nói (Voice Home)

Khung "tùy chỉnh video" độ trung thực cao 3DreamBooth mã nguồn mở: Tương thích hoàn hảo với Hunyuan và Wan 2.1, điều khiển camera 360 độ không góc chết, cứu tinh cho lỗi xuyên thấu (clipping) trong video AI!

Phương ngữ, hệ thống giọng nói 4 trong 1 cấp công nghiệp · Qwen3-ASR (Alibaba) — 52 ngôn ngữ... danh tính, tạo ra các cảnh quay chất lượng cao bao gồm bàn xoay cơ khí, bục trưng bày phản chiếu đá cẩm thạch...

Một cốc Cola trò chuyện về AI

3 người trong nửa năm xây dựng công cụ nhận dạng giọng nói -- Hành trình tự nghiên cứu nhận dạng giọng nói của 58.com

Cần bao phủ tất cả các kịch bản, vì vậy chúng tôi đã chia nhiệm vụ 3500 giờ theo mức độ ưu tiên của kịch bản... Mô-đun nhận dạng giọng nói (ASR) chuyển đổi âm thanh đầu vào thành văn bản tương ứng, cho toàn bộ hệ thống...

Công nghệ 58 (58 Technology)

Tin nóng | Ba nhà khoa học kiệt xuất của "Nhà Ngỗng" (Tencent) trò chuyện về học máy, điện toán lượng tử và nhận dạng giọng nói, hãy đến xem có những kiến thức bổ ích gì nào?

Giám đốc Tencent AI Lab, chuyên gia trong lĩnh vực học máy và dữ liệu lớn. Gia nhập Tencent vào tháng 3 năm 2017... Các kịch bản khác có thể sử dụng nhận dạng khuôn mặt để xác thực danh tính. Các ứng dụng tương tự như kịch bản này...

Tencent Academy+

OpenAI công bố nghiên cứu về "Meta-Prompt" | OrionStar công bố mô hình lớn đa ngôn ngữ Orion-14B | Đạt được khả năng nhập vai tùy ý cho mô hình lớn thông qua tự căn chỉnh, điểm tin bài báo nghiên cứu

Nghiên cứu toàn diện về mô hình nhận dạng giọng nói đa ngôn ngữ và hoàn toàn phi tự hồi quy kết hợp với mô hình lớn. Tiêu đề: Multilingual and Fully Non-Autoregressive ASR with Large...

cheatPPT

12 Trang tiếp theo

Tìm thấy khoảng 11 kết quả

TencentNhận diện giọng nóiASRAICông nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Jiqizhixin. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.