Universal-3.5 Pro from @AssemblyAI is live on OpenRouter, 50% off through September 29! Speech-to-t…
DịchMô hình Universal-3.5 Pro của AssemblyAI đã có mặt trên OpenRouter, hỗ trợ chuyển đổi giọng nói sang văn bản cho 19 ngôn ngữ với độ chính xác hàng đầu. Người dùng có thể nhận kết quả nhanh kèm dấu thời gian và độ tin cậy, hiện đang được giảm giá 50% đến hết ngày 29/9.
SpaceXAI vừa giới thiệu Grok Voice Transcribe 2.0 với tỷ lệ lỗi giảm một nửa so với bản tiền nhiệm trong khi giữ nguyên giá thành. Mô hình này hiện đứng đầu về độ chính xác trong số 32 mô hình streaming trên nền tảng Artificial Analysis.
xAI vừa phát hành mô hình chuyển đổi giọng nói thành văn bản Grok Voice Transcribe 2.0 với độ chính xác vượt trội gấp đôi phiên bản cũ, trong khi vẫn giữ nguyên mức giá cạnh tranh.
SPACEXAI 🔥: Grok Voice Transcribe 2.0, a new multilingual speech-to-text model, has been announced….
DịchSpaceXAI vừa giới thiệu Grok Voice Transcribe 2.0, mô hình được đánh giá là chính xác nhất hiện nay, dẫn đầu bảng xếp hạng 32 mô hình truyền phát của Artificial Analysis.
DịchX (trước đây là Twitter) vừa công bố Grok Voice Transcribe 2.0, được khẳng định là mô hình chuyển đổi giọng nói thành văn bản có độ chính xác cao nhất hiện nay trên toàn cầu.
First release of the day: Grok voice transcribe 2.0. much cheaper and fewer error than the competiti…
DịchGrok vừa trình làng phiên bản 2.0 của tính năng chuyển đổi giọng nói với ưu thế vượt trội về chi phí và khả năng giảm thiểu lỗi so với các đối thủ cạnh tranh.
DịchAlexandr Wang đánh giá cao mô hình Muse Voice của Meta với tốc độ xử lý nhanh gấp 10 lần Whisper của OpenAI, đồng thời sở hữu độ chính xác vượt trội.
MAI-Transcribe-2 hit 1 million requests on Open Router in 5 days! It's the fastest, most accurate an…
DịchMAI-Transcribe-2 vừa cán mốc 1 triệu lượt yêu cầu trên Open Router chỉ sau 5 ngày ra mắt, khẳng định vị thế là mô hình chuyển đổi giọng nói nhanh, chính xác và tiết kiệm chi phí nhất hiện nay.
Microsoft vừa giới thiệu MAI-Transcribe-2, mô hình chuyển đổi giọng nói nhanh và tiết kiệm nhất của hãng, hỗ trợ 60 ngôn ngữ với tỷ lệ lỗi từ chỉ 5,2%.
Microsoft AI has released MAI-Transcribe-2, achieving 2.0% AA-WER (#2) at ~411x real time (#2) for $…
DịchMicrosoft vừa trình làng mô hình MAI-Transcribe-2 với tỷ lệ lỗi chỉ 2.0%, xếp thứ hai trên bảng xếp hạng Artificial Analysis, vượt qua ElevenLabs và bám sát đối thủ từ Alibaba.
Fastest. Cheapest. Best. … MAI-Transcribe-2 10x faster than GPT-Transcribe. 5x faster than Gemini …
DịchMustafa Suleyman công bố MAI-Transcribe-2 với tốc độ vượt trội gấp 5-10 lần các đối thủ, dẫn đầu bảng xếp hạng Artificial Analysis về độ chính xác và độ trễ với mức giá cạnh tranh nhất.
1/ today we're rolling out muse voice transcribe, our first real-time audio perception model - SOTA …
DịchMeta vừa giới thiệu Muse Voice Transcribe, một mô hình AI tiên tiến được thiết kế để chuyển đổi giọng nói thành văn bản với độ chính xác cao và tốc độ phản hồi theo thời gian thực.
Google ra mắt Gemini 3.5 Transcribe, mô hình chuyên biệt cho chuyển đổi giọng nói với độ chính xác cao, hỗ trợ hơn 85 ngôn ngữ, tách lời người nói và tùy chỉnh từ vựng chuyên ngành.
Diễn biến sự kiện · 6 bài →Thêm 4 nguồn khác đưa tinMarkTechPostHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)The Decoder: AI NewsIT Home
Vì sao đáng đọc: Đây là công cụ cực kỳ hữu ích cho người làm nội dung và lập trình viên, giải quyết trực tiếp các vấn đề về độ chính xác và chi phí trong xử lý âm thanh.
Google vừa giới thiệu Gemini 3.5 Transcribe, mô hình AI đạt tỷ lệ lỗi từ (WER) chỉ 2,6% trên hơn 85 ngôn ngữ, hỗ trợ xử lý cả tệp ghi âm lẫn luồng dữ liệu trực tiếp.
Google giới thiệu mô hình Gemini 3.5 Transcribe hỗ trợ hơn 85 ngôn ngữ, có khả năng tự động lọc từ thừa, sửa lỗi nói và định dạng văn bản. Mô hình này giảm 70% độ trễ so với thế hệ trước, đạt tỷ lệ lỗi cực thấp.
Gemini 3.5 Transcribe giúp loại bỏ các từ đệm như "ừ", "à" và tự sửa lỗi nói vấp, tăng tốc độ xử lý 70% so với thế hệ cũ. Mô hình hỗ trợ 85 ngôn ngữ và hiện đã được tích hợp vào tính năng Rambler trên bàn phím Gboard của Pixel 11.
Google has released Gemini 3.5 Transcribe, ranking #5 on AA-WER at 2.6%, alongside Gemini 3.5 Transc…
DịchGoogle giới thiệu bộ API Gemini 3.5 Transcribe với khả năng xử lý âm thanh siêu tốc, độ trễ thấp chỉ 0.4 giây và hỗ trợ hơn 85 ngôn ngữ, thiết lập chuẩn mực mới cho công nghệ nhận diện giọng nói.
Google giới thiệu Gemini 3.5 Transcribe, mô hình AI giúp chuyển đổi giọng nói thành văn bản với khả năng tự động lọc từ thừa và trau chuốt nội dung. Tốc độ xử lý nhanh hơn 70% và giảm tỷ lệ lỗi thời gian thực xuống còn 5,5% so với thế hệ trước.
Google giới thiệu Gemini 3.5 Transcribe, mô hình AI hỗ trợ hơn 85 ngôn ngữ, có khả năng tự động định dạng văn bản, loại bỏ các từ đệm (um, ah) và nhận diện thuật ngữ chuyên ngành với độ chính xác cao.
Today we're introducing Gemini 3.5 Transcribe, our latest transcription model built for incredibly p…
DịchGoogle giới thiệu mô hình Gemini 3.5 Transcribe hỗ trợ hơn 85 ngôn ngữ, có khả năng lọc tạp âm, định dạng văn bản và xử lý lệnh thoại dựa trên ngữ cảnh màn hình để soạn thảo nội dung trực tiếp.
Say hello to Gemini 3.5 Transcribe! - Build apps that understand user speech / intent, even w/ mult…
DịchGemini 3.5 Transcribe hỗ trợ nhận diện hơn 85 ngôn ngữ, xử lý tốt các cuộc hội thoại nhiều người nói và cho phép tùy chỉnh từ vựng chuyên ngành. Công cụ hiện đã có mặt trên Google AI Studio, Gemini Enterprise và ứng dụng Gemini.
Google DeepMind vừa trình làng Gemini 3.5 Transcribe, mô hình chuyển đổi giọng nói thành văn bản với độ chính xác vượt trội, hỗ trợ hơn 85 ngôn ngữ, nhận diện đa người nói và tùy chỉnh từ vựng linh hoạt.
Diễn biến sự kiện · 8 bài →Thêm 15 nguồn khác đưa tinX: Rohan Paul (@rohanpaul_ai)Google AI: DEV tác giảMarkTechPostHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)The Decoder: AI NewsIT HomeX: Artificial Analysis (@ArtificialAnlys)Ars Technica: AIX: Ammaar Reshi (@ammaar)X: Logan Kilpatrick (@OfficialLoganK)X: Google AI (@GoogleAI)X: Google AI for Developers (@googleaidevs)X: Sundar Pichai (@sundarpichai)X: Google DeepMind (@GoogleDeepMind)The Verge: AI
Vì sao đáng đọc: Đây là bước tiến quan trọng trong công nghệ xử lý giọng nói của Google, có tính ứng dụng thực tế cao cho các nhà phát triển và doanh nghiệp.
Supertranscribe = S-tier. Cohere is now the default local model for @superwhisper onboarding. Dicta…
DịchSuperwhisper đã tích hợp Cohere làm mô hình mặc định cho trải nghiệm chuyển đổi giọng nói thành văn bản cục bộ, cho phép người dùng ghi chú ý tưởng ngay trên thiết bị mà không cần kết nối internet.
Google nâng cấp công cụ Rambler trên Gboard với khả năng học từ vựng cá nhân và tự động loại bỏ từ thừa khi chuyển đổi giọng nói thành văn bản, tích hợp sâu vào hệ sinh thái Gemini.