22/09

Thứ Ba · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnSteerDuplex: Mô hình hội thoại giọng nói song công có khả năng tùy biến linh hoạt

SteerDuplex là mô hình hội thoại song công (full-duplex) đột phá, cho phép người dùng điều chỉnh linh hoạt tông giọng, phong cách và tốc độ nói thông qua các hướng dẫn trực tiếp, giúp tương tác tự nhiên và thông minh hơn.


Vì sao đáng đọc: Nghiên cứu giải quyết vấn đề quan trọng về khả năng tùy biến trong hội thoại thời gian thực, kết hợp kỹ thuật RL tiên tiến, rất có giá trị cho tương lai của trợ lý ảo.

16/09

Thứ Tư · 1 tin

15/09

Thứ Ba · 1 tin
ModelBest OpenBMB@OpenBMB
NgànhĐiểm AI 26/100

Ra mắt Kahya-TTS: Mô hình chuyển văn bản thành giọng nói tiếng Thổ Nhĩ Kỳ từ VoxCPM2

🇹🇷🎙️ Kahya-TTS is live - a great example of fine-tuning VoxCPM2 with ~100 hours of natural Turkis…

DịchKahya-TTS là mô hình TTS tiếng Thổ Nhĩ Kỳ được tinh chỉnh từ VoxCPM2 với 100 giờ dữ liệu giọng nói tự nhiên, mang lại chất lượng âm thanh vượt trội cho cộng đồng mã nguồn mở.

09/09

Thứ Tư · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 48/100

AuK: Mô hình nền tảng mã nguồn mở đột phá trong tạo và chỉnh sửa giọng nói

AuK là mô hình nền tảng đa năng cho phép tạo và chỉnh sửa giọng nói thông qua ngôn ngữ tự nhiên, được huấn luyện trên quy mô dữ liệu khổng lồ. Phiên bản AuK-Flash tối ưu hóa tốc độ suy luận nhanh gấp 4.5 lần, mở ra tiềm năng ứng dụng lớn cho các nhà phát triển.

21/08

Thứ Sáu · 2 tin
JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnFireRedTTS3 từ Xiaohongshu: Mô hình AI 'đa năng' biết nói 24 ngôn ngữ, tự thiết kế giọng nói và chỉnh sửa âm thanh cực chuẩn

FireRedTTS3 tích hợp khả năng sao chép giọng nói zero-shot, thiết kế âm thanh qua mô tả văn bản và chỉnh sửa giọng nói chính xác trong một mô hình duy nhất, đạt hiệu suất dẫn đầu ngành trên nhiều bảng xếp hạng.


Vì sao đáng đọc: Đây là bước tiến đột phá trong công nghệ TTS khi hợp nhất ba tác vụ phức tạp vào một mô hình, có tính ứng dụng thực tế cao và hiệu suất vượt trội so với các đối thủ hiện nay.
Tổng 6 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (15 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Xử lý giọng nói” | AIHOT.vn