Hôm qua · 27/09

Chủ Nhật · 1 tin
MarkTechPost
Mô hìnhĐiểm AI 47/100

Sarvam AI ra mắt Saaras V4: Mô hình chuyển đổi giọng nói thành văn bản hỗ trợ 22 ngôn ngữ Ấn Độ và tiếng Anh toàn cầu

Sarvam AI vừa giới thiệu Saaras V4, mô hình nhận diện giọng nói đạt độ chính xác SOTA trên toàn bộ 22 ngôn ngữ chính thức của Ấn Độ, đồng thời bổ sung khả năng xử lý đa dạng các giọng tiếng Anh quốc tế.

24/09

Thứ Năm · 2 tin
Artificial Intelligence News (Web)
Sản phẩmĐiểm AI 59/100

Cùng sự kiệnGoogle ra mắt bộ đôi mô hình chuyển văn bản thành giọng nói Gemini 3.8 Flash TTS và Flash-Lite TTS

Google vừa giới thiệu Gemini 3.8 Flash TTS và Gemini 3.8 Flash-Lite TTS, tối ưu hóa cho các tác vụ lồng tiếng sáng tạo và xử lý tự động hóa với tốc độ cao.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.8 Flash TTS và Flash-Lite TTS: Đột phá công nghệ chuyển văn bản thành giọng nói»
IT Home
Sản phẩmĐiểm AI 75/100

OPPO Enco X4 ra mắt: Tai nghe đầu tiên sở hữu âm thanh Dynaudio lossless và tính năng dịch thuật AI thời gian thực

OPPO Enco X4 chính thức lên kệ với giá ưu đãi 1099 NDT, nổi bật nhờ công nghệ âm thanh lossless 2.3Mbps và chip 6nm mạnh mẽ. Đặc biệt, tai nghe tích hợp tính năng AI dịch thuật trực tiếp 24 ngôn ngữ mà không cần qua điện thoại.

23/09

Thứ Tư · 3 tin
Google AI@GoogleAI
Sản phẩmĐiểm AI 61/100

Cùng sự kiệnGoogle ra mắt Gemini 3.8 Flash TTS và Gemini 3.8 Flash-Lite TTS: Bước tiến mới trong công nghệ giọng nói

We're launching Gemini 3.8 Flash TTS and Gemini 3.8 Flash-Lite TTS ⚡️ Our most expressive audio mod…

DịchGoogle giới thiệu hai mô hình Gemini 3.8 Flash TTS và Gemini 3.8 Flash-Lite TTS, hỗ trợ hơn 100 ngôn ngữ với khả năng tùy chỉnh giọng nói linh hoạt, cho phép tạo ra hàng giờ âm thanh chất lượng cao, mượt mà và nhất quán.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.8 Flash TTS và Flash-Lite TTS: Đột phá công nghệ chuyển văn bản thành giọng nói»
Google DeepMind@GoogleDeepMind
Sản phẩmĐiểm AI 57/100

Cùng sự kiệnGoogle DeepMind ra mắt bộ đôi mô hình chuyển văn bản thành giọng nói Gemini 3.8 Flash TTS và Flash-Lite TTS

Create and deploy custom audio with our new text-to-speech models: 🔵 Gemini 3.8 Flash TTS: Design …

DịchGoogle DeepMind vừa giới thiệu Gemini 3.8 Flash TTS cho phép tùy chỉnh giọng nói độc bản và Gemini 3.8 Flash-Lite TTS tập trung vào hiệu suất cao, tối ưu cho các ứng dụng quy mô lớn.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.8 Flash TTS và Flash-Lite TTS: Đột phá công nghệ chuyển văn bản thành giọng nói»

22/09

Thứ Ba · 2 tin
Suno: Blog (Web)
Sản phẩmĐiểm AI 33/100

Suno giải mã bộ nén âm thanh: Tính năng mới đã có mặt trên Suno Studio

Suno vừa ra mắt bài viết chuyên sâu về cách bộ nén (compressor) tối ưu hóa dải động âm thanh. Đồng thời, Suno Studio đã tích hợp sẵn công cụ này cho người dùng gói Premier, hỗ trợ xử lý hậu kỳ chuyên nghiệp ngay trên nền tảng.

Thêm 1 nguồn khác đưa tinX: Suno (@suno)

21/09

Thứ Hai · 1 tin

15/09

Thứ Ba · 1 tin

10/09

Thứ Năm · 1 tin

08/09

Thứ Ba · 1 tin

07/09

Thứ Hai · 1 tin

05/09

Thứ Bảy · 3 tin
IT Home
Sản phẩmĐiểm AI 82/100

Ông lớn nhạc cụ Roland gia nhập thị trường AI với plugin hỗ trợ sáng tác Melody Flip

Roland vừa ra mắt Melody Flip, một plugin DAW sử dụng AI để hỗ trợ người dùng tạo ra các đoạn melody, hợp âm và nhịp điệu. Khác với các công cụ tạo nhạc hoàn chỉnh, plugin này tập trung vào việc cung cấp các ý tưởng sáng tạo làm nền tảng để nhạc sĩ tiếp tục phát triển tác phẩm chuyên sâu.

IT Home
Sản phẩmĐiểm AI 65/100

Tai nghe gaming Aula G9 ra mắt: Thiết kế thay pin nhanh, driver 53mm, giá 269 tệ

Aula G9 là mẫu tai nghe gaming mới với thiết kế thay pin độc đáo, tích hợp chip âm thanh C-Media và thuật toán AI giúp tối ưu hóa âm thanh trong game FPS. Sản phẩm hỗ trợ 4 chế độ kết nối linh hoạt cùng driver 53mm cho trải nghiệm âm thanh vòm 7.1 sống động.

04/09

Thứ Sáu · 1 tin

03/09

Thứ Năm · 1 tin
Kim@kimmonismus
Mô hìnhĐiểm AI 50/100

Inworld ra mắt Realtime TTS-2: Đứng đầu bảng xếp hạng giọng nói AI của Artificial Analysis

Inworld's Realtime TTS-2 is now generally available and currently ranks #1 in Artificial Analysis' C…

DịchInworld chính thức phát hành Realtime TTS-2, mô hình được đánh giá nhanh nhất phân khúc trên Artificial Analysis. Người dùng có thể tùy chỉnh cảm xúc và ngữ điệu linh hoạt thông qua mô tả văn bản, dựa trên những phản hồi tích cực từ phiên bản thử nghiệm trước đó.

Thêm 1 nguồn khác đưa tinX: Artificial Analysis (@ArtificialAnlys)

02/09

Thứ Tư · 2 tin
AI at Meta@AIatMeta
Mô hìnhĐiểm AI 61/100

Meta ra mắt Muse Voice Transcribe: Mô hình nhận diện âm thanh thời gian thực đột phá

Introducing Muse Voice Transcribe, the first real-time audio perception model from Meta Superintelli…

DịchMeta giới thiệu Muse Voice Transcribe, mô hình nhận diện giọng nói thời gian thực hỗ trợ đa ngôn ngữ, phân tách người nói và chuyển đổi ngôn ngữ linh hoạt. Công nghệ này hiện dẫn đầu các bảng xếp hạng về khả năng chuyển đổi giọng nói thành văn bản.

Thêm 7 nguồn khác đưa tinIT HomeX: Rohan Paul (@rohanpaul_ai)MarkTechPostX: Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI) (@alexandr_wang)X: Artificial Analysis (@ArtificialAnlys)X: Testing Catalog (@testingcatalog)X: Mark Zuckerberg (@finkd)

27/08

Thứ Năm · 1 tin
Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 64/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Đột phá tốc độ và độ chính xác trong chuyển đổi giọng nói

Google has released Gemini 3.5 Transcribe, ranking #5 on AA-WER at 2.6%, alongside Gemini 3.5 Transc…

DịchGoogle giới thiệu bộ API Gemini 3.5 Transcribe với khả năng xử lý âm thanh siêu tốc, độ trễ thấp chỉ 0.4 giây và hỗ trợ hơn 85 ngôn ngữ, thiết lập chuẩn mực mới cho công nghệ nhận diện giọng nói.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»

26/08

Thứ Tư · 1 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 54/100

Breeze TTS 2 soán ngôi vương bảng xếp hạng mô hình giọng nói mã nguồn mở

Breeze TTS 2 is now the leading Open Weights TTS model in the Artificial Analysis Provider Voices Sp…

DịchBreeze TTS 2 vừa vươn lên dẫn đầu các mô hình TTS mã nguồn mở trên bảng xếp hạng Artificial Analysis với 1.215 điểm Elo, vượt xa Fish Audio S2 Pro tới 90 điểm.

25/08

Thứ Ba · 1 tin

24/08

Thứ Hai · 1 tin
IT Home
Sản phẩmĐiểm AI 75/100

Honor ra mắt tai nghe kẹp vành FlyClip 3i: Thiết kế thời trang, chống ồn AI, giá ưu đãi chỉ từ 700.000 VNĐ

Honor vừa mở bán mẫu tai nghe kẹp vành FlyClip 3i với trọng lượng siêu nhẹ 5.2g, tích hợp công nghệ chống ồn AI và tính năng dịch thuật thời gian thực. Sản phẩm có thời lượng pin lên tới 48 giờ, hỗ trợ kháng nước IP55 và đang được áp dụng chính sách trợ giá hấp dẫn.

22/08

Thứ Bảy · 1 tin
Suno@suno
Hướng dẫnĐiểm AI 23/100

Suno trình diễn kỹ thuật phối hợp hòa âm và tạo nhạc cụ dây trực tiếp

On this week's In The Cut, watch Keyon Harrold and Christian Rich layer live chords and generated st…

DịchTrong tập mới nhất của chương trình In The Cut, nghệ sĩ Keyon Harrold và Christian Rich đã thực hiện màn trình diễn kết hợp giữa hòa âm trực tiếp và nhạc cụ dây do AI tạo ra tại Westlake Studios.

17/08

Thứ Hai · 2 tin
IT Home
NgànhĐiểm AI 88/100

Tinh chọnĐột phá công nghệ: Chế tạo robot siêu nhỏ vận hành hoàn toàn bằng sóng âm

Các nhà khoa học tại EPFL đã phát triển robot siêu nhỏ (tàu và thiết bị bay) sử dụng buồng cộng hưởng 3D để chuyển đổi sóng âm thành lực đẩy, loại bỏ hoàn toàn nhu cầu về động cơ hay linh kiện cơ khí phức tạp.


Vì sao đáng đọc: Công nghệ đột phá, thay đổi tư duy về thiết kế robot siêu nhỏ. Tính ứng dụng cao trong y sinh và kỹ thuật chính xác, nội dung mang tính khoa học chuyên sâu nhưng dễ hiểu.

14/08

Thứ Sáu · 1 tin

13/08

Thứ Năm · 2 tin

12/08

Thứ Tư · 1 tin
Tổng 31 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (48 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Công nghệ âm thanh” | AIHOT.vn