14/09

Thứ Hai · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Xây dựng và đánh giá hệ thống chuyển văn bản thành giọng nói tiếng Thái cố định từ dữ liệu tổng hợp

Nghiên cứu đề xuất phương pháp huấn luyện mô hình TTS nhỏ gọn bằng cách sử dụng mô hình sao chép giọng nói lớn làm nguồn dữ liệu tổng hợp, giúp tối ưu hóa hiệu năng cho các ngôn ngữ ít tài nguyên như tiếng Thái.

10/09

Thứ Năm · 1 tin
AK@_akhaliq
NgànhĐiểm AI 29/100

AuK: Mô hình nền tảng mã nguồn mở cho phép tạo và chỉnh sửa giọng nói

AuK Technical Report An Open-Source Foundational Model for Speech Generation and Editing paper: ht…

DịchAuK là mô hình nền tảng mã nguồn mở mới, hỗ trợ khả năng tạo và chỉnh sửa giọng nói linh hoạt. Đây là bước tiến đáng chú ý cho cộng đồng nghiên cứu âm thanh AI.

09/09

Thứ Tư · 1 tin
MarkTechPost
Sản phẩmĐiểm AI 69/100

Gradium ra mắt Voice Design: Tạo giọng nói AI độc bản chỉ từ văn bản mô tả

Gradium vừa giới thiệu Voice Design, công cụ cho phép tạo ra các giọng nói tổng hợp mới hoàn toàn chỉ trong vài giây thông qua mô tả văn bản mà không cần âm thanh mẫu. Công cụ hiện hỗ trợ 5 ngôn ngữ và đã mở miễn phí cho người dùng trên nền tảng của hãng.

13/08

Thứ Năm · 2 tin
WeChat: Xiaohongshu Tech (dots.llm)
Mô hìnhĐiểm AI 75/100

Tinh chọnXiaohongshu ra mắt dots.tts: Mô hình tổng hợp giọng nói tự hồi quy mã nguồn mở mới

Đội ngũ dots của Xiaohongshu vừa công bố mô hình tổng hợp giọng nói (TTS) end-to-end với 2 tỷ tham số, đạt hiệu suất vượt trội về độ chính xác nội dung và khả năng mô phỏng giọng nói trên bộ đánh giá Seed-TTS-Eval.

Diễn biến sự kiện · 1 bài →

Vì sao đáng đọc: Đây là bước tiến đáng chú ý trong lĩnh vực TTS mã nguồn mở, mang lại hiệu năng cạnh tranh cao và giá trị thực tiễn cho cộng đồng phát triển AI.
JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnDots.tts: Mô hình tổng hợp giọng nói mã nguồn mở đột phá từ Xiaohongshu

Dots.tts là mô hình TTS 2 tỷ tham số sử dụng cơ chế tự hồi quy trong không gian ẩn liên tục, loại bỏ hoàn toàn token rời rạc để đạt độ chính xác và tính tự nhiên vượt trội, đồng thời hỗ trợ mạnh mẽ cho các tác vụ chỉnh sửa giọng nói.

Thêm 1 nguồn khác đưa tinWeChat: Xiaohongshu Tech (dots.llm)

Vì sao đáng đọc: Đây là bước tiến kỹ thuật quan trọng trong lĩnh vực TTS, giải quyết hạn chế của token rời rạc. Việc mã nguồn mở hoàn toàn cùng hiệu suất SOTA khiến nó trở thành tin tức giá trị.
Tổng 5 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (26 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Tổng hợp giọng nói” | AIHOT.vn