29/08

Thứ Bảy · 6 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 37/100

Cùng sự kiệnWikiSkill: Google nâng cấp khả năng tự học cho AI thông qua hệ thống Wiki bền vững

Beautiful paper from Google. Skill-evolving agents rewrite a skill file each round, but the reason…

DịchGoogle giới thiệu WikiSkill, phương pháp giúp AI ghi lại lịch sử thất bại và tinh chỉnh kỹ năng thông qua cấu trúc Wiki ba tầng. Kết quả trên Gemini-3.5-Flash cho thấy hiệu suất vượt trội, đạt 68,1% trong các bài kiểm tra so với 56,1% của các phương pháp truyền thống.

Cùng sự kiện, bài đại diện «Google ra mắt WikiSkill: Giúp AI tự học từ sai lầm để nâng cao hiệu suất»
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 46/100

Cùng sự kiệnGoogle giới thiệu SKILL.state: Tối ưu hóa bộ nhớ cho AI Agent, giảm 16 lần lượng token

New Google paper makes a strong case for replacing ever-growing agent histories with a small, explic…

DịchGoogle đề xuất SKILL.state, phương pháp thay thế lịch sử hội thoại dài dòng bằng trạng thái thực thi rõ ràng. Giải pháp này giúp Gemini-3-Flash đạt độ chính xác cao hơn trong khi tiết kiệm tới 16,2 lần lượng token so với các phương pháp truyền thống.

Cùng sự kiện, bài đại diện «Google giới thiệu SKILL.state: Tối ưu hóa bộ nhớ cho AI tác vụ dài»
Kim@kimmonismus
Mô hìnhĐiểm AI 44/100

Google tăng tốc cuộc đua AI: Gemini 3.8 sắp ra mắt dù bản 3.7 mới trình làng

Things are now picking up speed: Gemini 3.8 is presumably about to be released. Though Gemini 3.7 is…

DịchChỉ vài tuần sau khi ra mắt Gemini 3.7, Google đã bắt đầu thử nghiệm nội bộ phiên bản 3.8 với hiệu năng vượt trội, cho thấy quyết tâm bám đuổi quyết liệt các đối thủ như OpenAI và Anthropic.

28/08

Thứ Sáu · 17 tin
Krea AI@krea_ai
Sản phẩmĐiểm AI 55/100

Krea tích hợp Gemini Omni Flash 1.1: Hỗ trợ tạo video 4K và kéo dài thời lượng lên 40 giây

Gemini Omni Flash 1.1 is now live on Krea. generate drafts in 360p, upscale up to 4K, extend videos…

DịchKrea vừa cập nhật mô hình Gemini Omni Flash 1.1, cho phép người dùng tạo bản nháp 360p, nâng cấp lên 4K, kéo dài video tới 40 giây và sử dụng video tham chiếu để điều khiển chuyển động.

Google AI@GoogleAI
Sản phẩmĐiểm AI 41/100

Google ra mắt loạt model mới: Gemini 3.5 Transcribe và Gemini Omni 1.1 Flash

Here's what launched this week: - Gemini 3.5 Transcribe, our most precise speech-to-text model yet, …

DịchGoogle vừa trình làng Gemini 3.5 Transcribe với khả năng chuyển đổi giọng nói thành văn bản chính xác nhất hiện nay, cùng bản cập nhật Gemini Omni 1.1 Flash giúp nâng cấp mạnh mẽ tính năng tạo và chỉnh sửa video.

Google DeepMind@GoogleDeepMind
Mô hìnhĐiểm AI 56/100

Cùng sự kiệnGoogle ra mắt Gemini 1.1 Flash Omni: Bước tiến mới trong kiểm soát tạo video

We're rolling out Gemini Omni 1.1 Flash to make generative video highly controllable, faster to iter…

DịchGoogle vừa giới thiệu Gemini 1.1 Flash Omni, phiên bản tối ưu hóa giúp tăng khả năng kiểm soát, đẩy nhanh tốc độ tạo video và đáp ứng tốt hơn cho các nhu cầu sản xuất chuyên nghiệp.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
JiQiZhiXin
Mô hìnhĐiểm AI 85/100

Cùng sự kiệnGoogle ra mắt Gemini Omni 1.1 Flash: Bước tiến mới trong công nghệ tạo video từ văn bản

Google vừa trình làng Gemini Omni 1.1 Flash với khả năng mở rộng video lên tới 40 giây, kiểm soát khung hình đầu-cuối và chế độ nháp 360p giúp tối ưu chi phí, hứa hẹn thay đổi cách làm phim bằng AI.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
MarkTechPost
Mô hìnhĐiểm AI 60/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói thành văn bản với độ chính xác vượt trội

Google vừa giới thiệu Gemini 3.5 Transcribe, mô hình AI đạt tỷ lệ lỗi từ (WER) chỉ 2,6% trên hơn 85 ngôn ngữ, hỗ trợ xử lý cả tệp ghi âm lẫn luồng dữ liệu trực tiếp.

Cùng sự kiện, tinh chọn hiển thị «Hướng dẫn toàn tập về Gemini 3.5 Transcribe: Giải pháp chuyển đổi giọng nói thành văn bản tối ưu»
IT Home
Mô hìnhĐiểm AI 66/100

Cùng sự kiệnGoogle ra mắt Gemini 1.1 Flash: Mô hình AI tạo video 4K siêu tốc và tiết kiệm

Google giới thiệu Gemini 1.1 Flash với khả năng tạo video 4K, hỗ trợ mở rộng cảnh lên tới 40 giây và tùy chỉnh khung hình linh hoạt. Mô hình này tối ưu hóa tốc độ và chi phí, giúp việc sản xuất video AI trở nên hiệu quả hơn đáng kể.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 73/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói thành văn bản siêu chính xác

Google vừa giới thiệu Gemini 3.5 Transcribe, mô hình chuyển đổi giọng nói thành văn bản chính xác nhất hiện nay, hỗ trợ xử lý âm thanh trực tiếp và ghi âm sẵn thông qua Live API.

Cùng sự kiện, tinh chọn hiển thị «Hướng dẫn toàn tập về Gemini 3.5 Transcribe: Giải pháp chuyển đổi giọng nói thành văn bản tối ưu»
Testing Catalog@testingcatalog
Sản phẩmĐiểm AI 33/100

Gemini Notebooks cập nhật tính năng nhập sách từ Google Play Books

GOOGLE 🔥: Users now can add select ebooks from Google Play Books to their Gemini Notebooks. > …

DịchNgười dùng hiện đã có thể thêm các đầu sách từ Google Play Books vào Gemini Notebooks. Google cũng xác nhận sẽ sớm mở rộng hỗ trợ cho sách giáo khoa, các gói đăng ký bên thứ ba và tích hợp sâu hơn vào ứng dụng Gemini.

Gemini@GeminiApp
Sản phẩmĐiểm AI 53/100

Cùng sự kiệnGemini 1.1 Flash ra mắt tính năng mở rộng video: Sáng tạo nội dung không giới hạn

Rev up your story by extending the scene with Gemini Omni 1.1 Flash. 🏎️ Now you can build longer s…

DịchGemini 1.1 Flash vừa cập nhật tính năng cho phép người dùng tải lên video và yêu cầu AI tiếp nối câu chuyện từ điểm dừng cuối cùng, giúp mở rộng kịch bản hoặc phát triển ý tưởng sáng tạo mới.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
Josh Woodward@joshwoodward
Sản phẩmĐiểm AI 34/100

Gemini Live nâng cấp mạnh mẽ: Trợ lý ảo giờ đây có thể thay bạn xử lý các tác vụ phức tạp

Look what you can do: - Tell Gemini what you want done - Gemini gets to work This is the Year of Vo…

DịchGoogle bổ sung loạt tính năng mới cho Gemini Live như quản lý email, lên lịch trình và xử lý công việc thông qua giọng nói, biến nó thành trợ lý cá nhân thực thụ thay vì chỉ là chatbot đối thoại.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 70/100

Cùng sự kiệnGoogle ra mắt Gemini Omni 1.1 Flash: Nâng cấp khả năng tạo và kiểm soát video chuyên sâu

Google giới thiệu Gemini Omni 1.1 Flash với các tính năng mới như mở rộng cảnh quay lên 40 giây, nội suy khung hình, tạo bản nháp 360p tốc độ cao và hỗ trợ xuất video 4K, tối ưu cho nhu cầu sáng tạo chuyên nghiệp.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
Gemini@GeminiApp
Sản phẩmĐiểm AI 53/100

Gemini Live nâng cấp tính năng Agent: Điều khiển mọi tác vụ bằng giọng nói

New productivity upgrades to Gemini Live bring in agentic capabilities, so you can do more with your…

DịchGemini Live vừa được bổ sung khả năng của AI Agent, cho phép người dùng xử lý email, nghe tóm tắt tin tức hàng ngày và tương tác với các ứng dụng như Spark chỉ bằng giọng nói.

The Decoder: AI News
Mô hìnhĐiểm AI 54/100

Cùng sự kiệnGoogle ra mắt Gemini 1.1 Flash: Bước tiến mới trong xử lý và tạo video AI

Google nâng cấp mô hình Gemini 1.1 Flash, cho phép phân tích video dài tới 40 giây thay vì chỉ 1 giây như trước, giúp tối ưu chi phí và tăng tính linh hoạt cho các tác vụ AI.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»

27/08

Thứ Năm · 17 tin
Logan Kilpatrick@OfficialLoganK
Mô hìnhĐiểm AI 54/100

Cùng sự kiệnGoogle ra mắt Gemini 1.5 Flash Omni: Bước tiến mới trong tạo video và xử lý đa phương thức

Excited to bring Gemini Omni Flash 1.1 to the world, this is an update to our anything in, anything …

DịchGemini 1.5 Flash Omni vừa được cập nhật khả năng tạo video mạnh mẽ, hỗ trợ mở rộng video lên đến 10 giây mỗi lần, nâng cấp độ phân giải 4K và sử dụng video tham chiếu để tạo nội dung nhất quán.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 47/100

Cùng sự kiệnGoogle ra mắt Gemini Omni 1.1 Flash: Hỗ trợ tạo video 4K chuyên nghiệp

GOOGLE 🔥: Gemini Omni 1.1 Flash has been officially announced and now available on Gemini APIs and …

DịchGoogle vừa phát hành mô hình đa phương thức Gemini Omni 1.1 Flash, cho phép người dùng tạo và chỉnh sửa video với khả năng kiểm soát chi tiết, hỗ trợ xuất chất lượng 4K và thử nghiệm nhanh ở độ phân giải 360p.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
Google AI@GoogleAI
Mô hìnhĐiểm AI 61/100

Cùng sự kiệnGoogle ra mắt Gemini 1.1 Flash: Bước tiến đột phá trong mở rộng bối cảnh video

Meet Gemini Omni 1.1 Flash ⚡️ Our newest multimodal model for video generation and editing. It now f…

DịchGoogle giới thiệu mô hình Gemini 1.1 Flash với khả năng mở rộng video dựa trên 10 giây ngữ cảnh, vượt xa giới hạn 1 giây của Veo, giúp duy trì tính nhất quán và kể chuyện dài hơi hơn.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
Google DeepMind: Blog
Mô hìnhĐiểm AI 70/100

Tinh chọnGoogle ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI

Google giới thiệu Gemini 1.1 Flash với khả năng kiểm soát video nâng cao, hỗ trợ mở rộng bối cảnh lên tới 40 giây, tạo chuyển cảnh mượt mà và xuất video độ phân giải 4K cho nhà phát triển.

Diễn biến sự kiện · 9 bài →Thêm 10 nguồn khác đưa tinMarkTechPostX: Google DeepMind (@GoogleDeepMind)X: Google AI (@GoogleAI)JiqizhixinIT HomeX: Gemini (@GeminiApp)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)The Decoder: AI NewsX: Logan Kilpatrick (@OfficialLoganK)X: Testing Catalog (@testingcatalog)

Vì sao đáng đọc: Cập nhật quan trọng về công cụ cho nhà phát triển, mở rộng khả năng xử lý video vốn là điểm nóng trong lĩnh vực AI tạo sinh hiện nay.
The Decoder: AI News
Mô hìnhĐiểm AI 62/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Chuyển đổi giọng nói sang văn bản đa ngôn ngữ với độ chính xác cao

Google giới thiệu mô hình Gemini 3.5 Transcribe hỗ trợ hơn 85 ngôn ngữ, có khả năng tự động lọc từ thừa, sửa lỗi nói và định dạng văn bản. Mô hình này giảm 70% độ trễ so với thế hệ trước, đạt tỷ lệ lỗi cực thấp.

Cùng sự kiện, tinh chọn hiển thị «Hướng dẫn toàn tập về Gemini 3.5 Transcribe: Giải pháp chuyển đổi giọng nói thành văn bản tối ưu»
IT Home
Mô hìnhĐiểm AI 62/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Mô hình chuyển giọng nói thành văn bản thông minh, tự động lọc từ thừa

Gemini 3.5 Transcribe giúp loại bỏ các từ đệm như "ừ", "à" và tự sửa lỗi nói vấp, tăng tốc độ xử lý 70% so với thế hệ cũ. Mô hình hỗ trợ 85 ngôn ngữ và hiện đã được tích hợp vào tính năng Rambler trên bàn phím Gboard của Pixel 11.

Cùng sự kiện, tinh chọn hiển thị «Hướng dẫn toàn tập về Gemini 3.5 Transcribe: Giải pháp chuyển đổi giọng nói thành văn bản tối ưu»
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 54/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: API chuyển đổi giọng nói thông minh

Incrdible release from Google, and one more friction gone from ditching my keyboard. Also looks lik…

DịchGoogle giới thiệu Gemini 3.5 Transcribe, API chuyển đổi giọng nói thành văn bản có khả năng tự động sửa lỗi, loại bỏ từ đệm và định dạng dữ liệu theo ngữ cảnh, hỗ trợ tùy chỉnh từ vựng chuyên ngành.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Ars Technica: AI
Mô hìnhĐiểm AI 58/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: AI chuyển đổi giọng nói thành văn bản thông minh

Google giới thiệu Gemini 3.5 Transcribe, mô hình AI giúp chuyển đổi giọng nói thành văn bản với khả năng tự động lọc từ thừa và trau chuốt nội dung. Tốc độ xử lý nhanh hơn 70% và giảm tỷ lệ lỗi thời gian thực xuống còn 5,5% so với thế hệ trước.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
The Verge: AI
Mô hìnhĐiểm AI 63/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: AI chuyển giọng nói thành văn bản thông minh, tự động lọc từ thừa

Google giới thiệu Gemini 3.5 Transcribe, mô hình AI hỗ trợ hơn 85 ngôn ngữ, có khả năng tự động định dạng văn bản, loại bỏ các từ đệm (um, ah) và nhận diện thuật ngữ chuyên ngành với độ chính xác cao.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Google AI@GoogleAI
Mô hìnhĐiểm AI 59/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Công cụ chuyển đổi giọng nói thông minh và đa năng

Today we're introducing Gemini 3.5 Transcribe, our latest transcription model built for incredibly p…

DịchGoogle giới thiệu mô hình Gemini 3.5 Transcribe hỗ trợ hơn 85 ngôn ngữ, có khả năng lọc tạp âm, định dạng văn bản và xử lý lệnh thoại dựa trên ngữ cảnh màn hình để soạn thảo nội dung trực tiếp.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Logan Kilpatrick@OfficialLoganK
Mô hìnhĐiểm AI 66/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói thành văn bản siêu tốc

Introducing Gemini 3.5 Transcribe, our new speech to text model with smart transcription, function c…

DịchGemini 3.5 Transcribe là mô hình chuyển đổi giọng nói mới với khả năng xử lý thời gian thực, hỗ trợ hơn 85 ngôn ngữ, nhận diện đa người nói và độ chính xác vượt trội.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Gemini@GeminiApp
Sản phẩmĐiểm AI 41/100

Gemini Live nâng cấp tính năng mới: Trợ lý ảo thông minh giúp quản lý công việc phức tạp

Gemini Live is moving beyond conversation to handle complex tasks on your behalf. With new features…

DịchGemini Live mở rộng khả năng từ trò chuyện sang hỗ trợ tác vụ thực tế như tóm tắt lịch trình, quản lý email và sắp xếp công việc qua giọng nói, giúp người dùng tối ưu hóa hiệu suất hàng ngày.

Thêm 1 nguồn khác đưa tinX: Josh Woodward (@joshwoodward, Google Labs VP)
Google DeepMind@GoogleDeepMind
Mô hìnhĐiểm AI 49/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói thành văn bản thế hệ mới

Gemini 3.5 Transcribe is our latest speech-to-text model for precise and intelligent transcriptions….

DịchGoogle DeepMind vừa giới thiệu Gemini 3.5 Transcribe, mô hình AI chuyên dụng cho khả năng chuyển đổi giọng nói thành văn bản với độ chính xác và thông minh vượt trội.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Sundar Pichai@sundarpichai
Mô hìnhĐiểm AI 67/100

Cùng sự kiệnGoogle ra mắt Gemini 3.5 Transcribe: Công cụ chuyển đổi giọng nói đa ngôn ngữ mạnh mẽ

Say hello to Gemini 3.5 Transcribe! - Build apps that understand user speech / intent, even w/ mult…

DịchGemini 3.5 Transcribe hỗ trợ nhận diện hơn 85 ngôn ngữ, xử lý tốt các cuộc hội thoại nhiều người nói và cho phép tùy chỉnh từ vựng chuyên ngành. Công cụ hiện đã có mặt trên Google AI Studio, Gemini Enterprise và ứng dụng Gemini.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực»
Google DeepMind: Blog
Mô hìnhĐiểm AI 68/100

Tinh chọnGoogle ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực

Google DeepMind vừa trình làng Gemini 3.5 Transcribe, mô hình chuyển đổi giọng nói thành văn bản với độ chính xác vượt trội, hỗ trợ hơn 85 ngôn ngữ, nhận diện đa người nói và tùy chỉnh từ vựng linh hoạt.

Diễn biến sự kiện · 8 bài →Thêm 15 nguồn khác đưa tinX: Rohan Paul (@rohanpaul_ai)Google AI: DEV tác giảMarkTechPostHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)The Decoder: AI NewsIT HomeX: Artificial Analysis (@ArtificialAnlys)Ars Technica: AIX: Ammaar Reshi (@ammaar)X: Logan Kilpatrick (@OfficialLoganK)X: Google AI (@GoogleAI)X: Google AI for Developers (@googleaidevs)X: Sundar Pichai (@sundarpichai)X: Google DeepMind (@GoogleDeepMind)The Verge: AI

Vì sao đáng đọc: Đây là bước tiến quan trọng trong công nghệ xử lý giọng nói của Google, có tính ứng dụng thực tế cao cho các nhà phát triển và doanh nghiệp.

26/08

Thứ Tư · 4 tin
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (56 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Gemini” — Trang 5 | AIHOT.vn