22/09

Thứ Ba · 1 tin
OpenRouter@OpenRouter
Mô hìnhĐiểm AI 45/100

AssemblyAI ra mắt Universal-3.5 Pro trên OpenRouter, ưu đãi 50% trong tuần đầu

Universal-3.5 Pro from @AssemblyAI is live on OpenRouter, 50% off through September 29! Speech-to-t…

DịchMô hình Universal-3.5 Pro của AssemblyAI đã có mặt trên OpenRouter, hỗ trợ chuyển đổi giọng nói sang văn bản cho 19 ngôn ngữ với độ chính xác hàng đầu. Người dùng có thể nhận kết quả nhanh kèm dấu thời gian và độ tin cậy, hiện đang được giảm giá 50% đến hết ngày 29/9.

19/09

Thứ Bảy · 5 tin
IT Home
Mô hìnhĐiểm AI 59/100

Cùng sự kiệnSpaceXAI ra mắt mô hình chuyển đổi giọng nói Grok Voice Transcribe 2.0: Độ chính xác tăng gấp đôi

SpaceXAI vừa giới thiệu Grok Voice Transcribe 2.0 với tỷ lệ lỗi giảm một nửa so với bản tiền nhiệm trong khi giữ nguyên giá thành. Mô hình này hiện đứng đầu về độ chính xác trong số 32 mô hình streaming trên nền tảng Artificial Analysis.

Cùng sự kiện, tinh chọn hiển thị «xAI ra mắt mô hình chuyển đổi giọng nói Grok Voice Transcribe 2.0 với độ chính xác vượt trội»
MarkTechPost
Sản phẩmĐiểm AI 64/100

xAI ra mắt Grok Voice Transcribe 2.0: Độ chính xác gấp đôi, giá không đổi

xAI vừa phát hành mô hình chuyển đổi giọng nói thành văn bản Grok Voice Transcribe 2.0 với độ chính xác vượt trội gấp đôi phiên bản cũ, trong khi vẫn giữ nguyên mức giá cạnh tranh.

Diễn biến sự kiện · 9 bài →Thêm 3 nguồn khác đưa tinIT HomeX: Artificial Analysis (@ArtificialAnlys)X: Testing Catalog (@testingcatalog)
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 53/100

Cùng sự kiệnSpaceXAI ra mắt Grok Voice Transcribe 2.0: Mô hình chuyển đổi giọng nói đa ngôn ngữ chính xác nhất

SPACEXAI 🔥: Grok Voice Transcribe 2.0, a new multilingual speech-to-text model, has been announced….

DịchSpaceXAI vừa giới thiệu Grok Voice Transcribe 2.0, mô hình được đánh giá là chính xác nhất hiện nay, dẫn đầu bảng xếp hạng 32 mô hình truyền phát của Artificial Analysis.

Cùng sự kiện, bài đại diện «xAI ra mắt Grok Voice Transcribe 2.0: Độ chính xác gấp đôi, giá không đổi»
Andrew Milich@milichab
Mô hìnhĐiểm AI 41/100

Cùng sự kiệnGrok Voice Transcribe 2.0 ra mắt: Mô hình chuyển đổi giọng nói chính xác nhất thế giới

Most accurate transcription model in the world

DịchX (trước đây là Twitter) vừa công bố Grok Voice Transcribe 2.0, được khẳng định là mô hình chuyển đổi giọng nói thành văn bản có độ chính xác cao nhất hiện nay trên toàn cầu.

Cùng sự kiện, bài đại diện «xAI ra mắt Grok Voice Transcribe 2.0: Mô hình chuyển đổi giọng nói chính xác nhất thế giới»
Kim@kimmonismus
Mô hìnhĐiểm AI 36/100

Cùng sự kiệnGrok ra mắt tính năng chuyển đổi giọng nói 2.0: Giá rẻ hơn, độ chính xác cao hơn

First release of the day: Grok voice transcribe 2.0. much cheaper and fewer error than the competiti…

DịchGrok vừa trình làng phiên bản 2.0 của tính năng chuyển đổi giọng nói với ưu thế vượt trội về chi phí và khả năng giảm thiểu lỗi so với các đối thủ cạnh tranh.

Cùng sự kiện, bài đại diện «xAI ra mắt Grok Voice Transcribe 2.0: Mô hình chuyển đổi giọng nói chính xác nhất thế giới»

16/09

Thứ Tư · 1 tin

11/09

Thứ Sáu · 1 tin
Mustafa Suleyman (Microsoft AI CEO)@mustafasuleyman
NgànhĐiểm AI 32/100

MAI-Transcribe-2 đạt 1 triệu lượt yêu cầu chỉ sau 5 ngày

MAI-Transcribe-2 hit 1 million requests on Open Router in 5 days! It's the fastest, most accurate an…

DịchMAI-Transcribe-2 vừa cán mốc 1 triệu lượt yêu cầu trên Open Router chỉ sau 5 ngày ra mắt, khẳng định vị thế là mô hình chuyển đổi giọng nói nhanh, chính xác và tiết kiệm chi phí nhất hiện nay.

04/09

Thứ Sáu · 1 tin

03/09

Thứ Năm · 2 tin
Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 55/100

Cùng sự kiệnMicrosoft ra mắt mô hình chuyển đổi giọng nói MAI-Transcribe-2, đạt vị trí thứ 2 trên bảng xếp hạng AA-WER

Microsoft AI has released MAI-Transcribe-2, achieving 2.0% AA-WER (#2) at ~411x real time (#2) for $…

DịchMicrosoft vừa trình làng mô hình MAI-Transcribe-2 với tỷ lệ lỗi chỉ 2.0%, xếp thứ hai trên bảng xếp hạng Artificial Analysis, vượt qua ElevenLabs và bám sát đối thủ từ Alibaba.

Cùng sự kiện, bài đại diện «Microsoft ra mắt MAI-Transcribe-2: Mô hình chuyển đổi giọng nói nhanh và rẻ nhất thị trường»
Mustafa Suleyman (Microsoft AI CEO)@mustafasuleyman
Mô hìnhĐiểm AI 48/100

Microsoft ra mắt MAI-Transcribe-2: Mô hình chuyển đổi giọng nói nhanh và rẻ nhất thị trường

Fastest. Cheapest. Best. … MAI-Transcribe-2 10x faster than GPT-Transcribe. 5x faster than Gemini …

DịchMustafa Suleyman công bố MAI-Transcribe-2 với tốc độ vượt trội gấp 5-10 lần các đối thủ, dẫn đầu bảng xếp hạng Artificial Analysis về độ chính xác và độ trễ với mức giá cạnh tranh nhất.

Thêm 4 nguồn khác đưa tinX: OpenRouter (@OpenRouter)IT HomeX: Artificial Analysis (@ArtificialAnlys)Microsoft AI: Blog chính thức (Web)

02/09

Thứ Tư · 1 tin
Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Mô hìnhĐiểm AI 51/100

Cùng sự kiệnMeta ra mắt Muse Voice Transcribe: Mô hình chuyển đổi giọng nói thành văn bản thời gian thực

1/ today we're rolling out muse voice transcribe, our first real-time audio perception model - SOTA …

DịchMeta vừa giới thiệu Muse Voice Transcribe, một mô hình AI tiên tiến được thiết kế để chuyển đổi giọng nói thành văn bản với độ chính xác cao và tốc độ phản hồi theo thời gian thực.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Voice Transcribe: Mô hình nhận diện âm thanh thời gian thực đột phá»

28/08

Thứ Sáu · 2 tin
Google AI: DEV tác giả
Hướng dẫnĐiểm AI 74/100

Tinh chọnHướng dẫn toàn tập về Gemini 3.5 Transcribe: Giải pháp chuyển đổi giọng nói thành văn bản tối ưu

Google ra mắt Gemini 3.5 Transcribe, mô hình chuyên biệt cho chuyển đổi giọng nói với độ chính xác cao, hỗ trợ hơn 85 ngôn ngữ, tách lời người nói và tùy chỉnh từ vựng chuyên ngành.

Diễn biến sự kiện · 6 bài →Thêm 4 nguồn khác đưa tinMarkTechPostHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)The Decoder: AI NewsIT Home

Vì sao đáng đọc: Đây là công cụ cực kỳ hữu ích cho người làm nội dung và lập trình viên, giải quyết trực tiếp các vấn đề về độ chính xác và chi phí trong xử lý âm thanh.
MarkTechPost
Mô hìnhĐiểm AI 60/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói thành văn bản với độ chính xác vượt trội

Google vừa giới thiệu Gemini 3.5 Transcribe, mô hình AI đạt tỷ lệ lỗi từ (WER) chỉ 2,6% trên hơn 85 ngôn ngữ, hỗ trợ xử lý cả tệp ghi âm lẫn luồng dữ liệu trực tiếp.

Cùng sự kiện, tinh chọn hiển thị «Hướng dẫn toàn tập về Gemini 3.5 Transcribe: Giải pháp chuyển đổi giọng nói thành văn bản tối ưu»

27/08

Thứ Năm · 8 tin
The Decoder: AI News
Mô hìnhĐiểm AI 62/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Chuyển đổi giọng nói sang văn bản đa ngôn ngữ với độ chính xác cao

Google giới thiệu mô hình Gemini 3.5 Transcribe hỗ trợ hơn 85 ngôn ngữ, có khả năng tự động lọc từ thừa, sửa lỗi nói và định dạng văn bản. Mô hình này giảm 70% độ trễ so với thế hệ trước, đạt tỷ lệ lỗi cực thấp.

Cùng sự kiện, tinh chọn hiển thị «Hướng dẫn toàn tập về Gemini 3.5 Transcribe: Giải pháp chuyển đổi giọng nói thành văn bản tối ưu»
IT Home
Mô hìnhĐiểm AI 62/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Mô hình chuyển giọng nói thành văn bản thông minh, tự động lọc từ thừa

Gemini 3.5 Transcribe giúp loại bỏ các từ đệm như "ừ", "à" và tự sửa lỗi nói vấp, tăng tốc độ xử lý 70% so với thế hệ cũ. Mô hình hỗ trợ 85 ngôn ngữ và hiện đã được tích hợp vào tính năng Rambler trên bàn phím Gboard của Pixel 11.

Cùng sự kiện, tinh chọn hiển thị «Hướng dẫn toàn tập về Gemini 3.5 Transcribe: Giải pháp chuyển đổi giọng nói thành văn bản tối ưu»
Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 64/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Đột phá tốc độ và độ chính xác trong chuyển đổi giọng nói

Google has released Gemini 3.5 Transcribe, ranking #5 on AA-WER at 2.6%, alongside Gemini 3.5 Transc…

DịchGoogle giới thiệu bộ API Gemini 3.5 Transcribe với khả năng xử lý âm thanh siêu tốc, độ trễ thấp chỉ 0.4 giây và hỗ trợ hơn 85 ngôn ngữ, thiết lập chuẩn mực mới cho công nghệ nhận diện giọng nói.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Ars Technica: AI
Mô hìnhĐiểm AI 58/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: AI chuyển đổi giọng nói thành văn bản thông minh

Google giới thiệu Gemini 3.5 Transcribe, mô hình AI giúp chuyển đổi giọng nói thành văn bản với khả năng tự động lọc từ thừa và trau chuốt nội dung. Tốc độ xử lý nhanh hơn 70% và giảm tỷ lệ lỗi thời gian thực xuống còn 5,5% so với thế hệ trước.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
The Verge: AI
Mô hìnhĐiểm AI 63/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: AI chuyển giọng nói thành văn bản thông minh, tự động lọc từ thừa

Google giới thiệu Gemini 3.5 Transcribe, mô hình AI hỗ trợ hơn 85 ngôn ngữ, có khả năng tự động định dạng văn bản, loại bỏ các từ đệm (um, ah) và nhận diện thuật ngữ chuyên ngành với độ chính xác cao.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Google AI@GoogleAI
Mô hìnhĐiểm AI 59/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Công cụ chuyển đổi giọng nói thông minh và đa năng

Today we're introducing Gemini 3.5 Transcribe, our latest transcription model built for incredibly p…

DịchGoogle giới thiệu mô hình Gemini 3.5 Transcribe hỗ trợ hơn 85 ngôn ngữ, có khả năng lọc tạp âm, định dạng văn bản và xử lý lệnh thoại dựa trên ngữ cảnh màn hình để soạn thảo nội dung trực tiếp.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Sundar Pichai@sundarpichai
Mô hìnhĐiểm AI 67/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Công cụ chuyển đổi giọng nói đa ngôn ngữ mạnh mẽ

Say hello to Gemini 3.5 Transcribe! - Build apps that understand user speech / intent, even w/ mult…

DịchGemini 3.5 Transcribe hỗ trợ nhận diện hơn 85 ngôn ngữ, xử lý tốt các cuộc hội thoại nhiều người nói và cho phép tùy chỉnh từ vựng chuyên ngành. Công cụ hiện đã có mặt trên Google AI Studio, Gemini Enterprise và ứng dụng Gemini.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Google DeepMind: Blog
Mô hìnhĐiểm AI 68/100

Tinh chọnGoogle ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực

Google DeepMind vừa trình làng Gemini 3.5 Transcribe, mô hình chuyển đổi giọng nói thành văn bản với độ chính xác vượt trội, hỗ trợ hơn 85 ngôn ngữ, nhận diện đa người nói và tùy chỉnh từ vựng linh hoạt.

Diễn biến sự kiện · 8 bài →Thêm 15 nguồn khác đưa tinX: Rohan Paul (@rohanpaul_ai)Google AI: DEV tác giảMarkTechPostHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)The Decoder: AI NewsIT HomeX: Artificial Analysis (@ArtificialAnlys)Ars Technica: AIX: Ammaar Reshi (@ammaar)X: Logan Kilpatrick (@OfficialLoganK)X: Google AI (@GoogleAI)X: Google AI for Developers (@googleaidevs)X: Sundar Pichai (@sundarpichai)X: Google DeepMind (@GoogleDeepMind)The Verge: AI

Vì sao đáng đọc: Đây là bước tiến quan trọng trong công nghệ xử lý giọng nói của Google, có tính ứng dụng thực tế cao cho các nhà phát triển và doanh nghiệp.

25/08

Thứ Ba · 1 tin
Cohere@cohere
NgànhĐiểm AI 39/100

Cohere trở thành mô hình mặc định trên Superwhisper

Supertranscribe = S-tier. Cohere is now the default local model for @superwhisper onboarding. Dicta…

DịchSuperwhisper đã tích hợp Cohere làm mô hình mặc định cho trải nghiệm chuyển đổi giọng nói thành văn bản cục bộ, cho phép người dùng ghi chú ý tưởng ngay trên thiết bị mà không cần kết nối internet.

14/08

Thứ Sáu · 1 tin
Tổng 24 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (43 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Chuyển đổi giọng nói” | AIHOT.vn