04/09

Thứ Sáu · 10 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 39/100

FlashRender: Khung dựng hình video thế hệ mới với khả năng điều khiển camera siêu tốc

FlashRender là khung dựng hình video đột phá giúp tái tạo video theo quỹ đạo camera mục tiêu chỉ trong vài giây, giảm 25 lần chi phí lấy mẫu mà vẫn đảm bảo chất lượng hình ảnh và tính nhất quán hình học vượt trội.

03/09

Thứ Năm · 5 tin
Ma Dongxi NLP@dongxi_nlp
Mô hìnhĐiểm AI 56/100

Ra mắt Video Delta Net (VDN): Mô hình tạo video từ văn bản thời gian thực với chất lượng gần như không suy giảm

Video Delta Net (VDN) đạt tốc độ tạo video vượt thời gian thực nhờ cơ chế Hybrid Attention, giúp tăng tốc Minimax-H3 lên tới 90 lần. Dự án đã mã nguồn mở toàn bộ checkpoint và mã nguồn, cho phép tạo video 768p dài 14 giây chỉ trong 11 giây trên 8 GPU B200.

Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 69/100

Wan 3.0 thống trị bảng xếp hạng Artificial Analysis: Đỉnh cao mới trong tạo video có âm thanh

Wan 3.0 debuts at #1 on the Artificial Analysis Video Editing Leaderboard, and is a close #2 in Text…

DịchMô hình Wan 3.0 của Alibaba vừa vươn lên dẫn đầu bảng xếp hạng chỉnh sửa video có âm thanh của Artificial Analysis, đồng thời xếp thứ hai ở hạng mục tạo video từ văn bản. Đây là mô hình đa năng hỗ trợ xuất video 1080p dài 30 giây với khả năng tùy chỉnh sâu qua văn bản, hình ảnh và âm thanh.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 50/100

SolarWM: Mô hình thế giới video tương tác mã nguồn mở, huấn luyện siêu tốc chỉ trong vài giây

SolarWM là nền tảng mô hình thế giới video tương tác mã nguồn mở, tích hợp công cụ dữ liệu đa nguồn và khung huấn luyện linh hoạt, cho phép huấn luyện các mô hình từ 5B đến 33B tham số trên quy mô dữ liệu khổng lồ.

MiniMax@MiniMax_AI
Sản phẩmĐiểm AI 31/100

MiniMax ra mắt tính năng tạo video 15 giây mô phỏng quá trình vẽ từ ảnh tham chiếu

Have you ever felt scared by how powerful your model is? This really makes me wonder: are we livin…

DịchMiniMax vừa giới thiệu khả năng biến ảnh nhân vật thành video 15 giây tái hiện toàn bộ quá trình sáng tạo từ phác thảo đến hoàn thiện, chỉ bằng một câu lệnh đơn giản.

02/09

Thứ Tư · 8 tin
Kling AI@Kling_ai
Hướng dẫnĐiểm AI 41/100

Hướng dẫn Kling AI: Sử dụng tính năng Elements để giữ nhất quán nhân vật qua nhiều cảnh quay

In this tutorial, learn how to use Elements in Kling MCP to maintain character identity across diffe…

DịchKling AI vừa ra mắt hướng dẫn sử dụng tính năng Elements trong Kling MCP, giúp người dùng duy trì ngoại hình nhân vật ổn định xuyên suốt các cảnh quay, từ đó tạo ra những câu chuyện video AI liền mạch và chuyên nghiệp hơn.

IT Home
Mô hìnhĐiểm AI 62/100

Cùng sự kiệnWorld Labs của Fei-Fei Li ra mắt Atlas: Mô hình thế giới đa phương thức hỗ trợ tạo video 1440p

World Labs vừa giới thiệu Atlas, mô hình thế giới đa phương thức có khả năng tái tạo không gian 3D và tạo video 1440p dài 1 phút với độ chính xác cao ở cấp độ pixel, cho phép kiểm soát camera linh hoạt.

Cùng sự kiện, bài đại diện «Fei-Fei Li ra mắt Atlas: Kỷ nguyên mới của mô hình thế giới đa phương thức»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 43/100

H3-World: Biến mô hình tạo video MiniMax-H3 thành trình điều khiển thế giới ảo

H3-World giới thiệu khung làm việc giúp chuyển đổi mô hình tạo video 33B MiniMax-H3 thành mô hình thế giới tương tác, cho phép điều khiển chính xác theo thời gian thực thông qua câu lệnh ngôn ngữ tự nhiên.

MiniMax@MiniMax_AI
Hướng dẫnĐiểm AI 35/100

Một tháng mở mã nguồn MiniMax H3: Cộng đồng tạo ra lớp học video tự động

We would never see this level of creation everywhere if SOTA video models stayed behind closed doors…

DịchSau một tháng mở quyền truy cập trọng số, MiniMax H3 đã được cộng đồng ứng dụng sáng tạo, tiêu biểu là công cụ tạo video bài giảng tự động chỉ từ một khái niệm đầu vào.

Google DeepMind: Blog
Sản phẩmĐiểm AI 71/100

Tinh chọnGoogle DeepMind ra mắt tính năng hiểu video thông minh cho Gemini

Google DeepMind cập nhật khả năng xử lý video thông minh cho dòng Gemini Flash, giúp mô hình tự động quét các phân đoạn quan trọng. Công nghệ này giúp giảm 88% lượng token, tiết kiệm 66% chi phí và tăng 7% độ chính xác so với phương pháp xử lý khung hình cố định truyền thống.

Diễn biến sự kiện · 2 bài →Thêm 4 nguồn khác đưa tinX: Google AI for Developers (@googleaidevs)X: Logan Kilpatrick (@OfficialLoganK)X: Google DeepMind (@GoogleDeepMind)The Decoder: AI News

Vì sao đáng đọc: Đây là bước tiến quan trọng trong tối ưu hóa chi phí và hiệu suất cho AI đa phương thức, có tác động trực tiếp đến người dùng doanh nghiệp và lập trình viên.

31/08

Thứ Hai · 4 tin

30/08

Chủ Nhật · 1 tin
MiniMax@MiniMax_AI
Hướng dẫnĐiểm AI 31/100

Mô hình MiniMax H3 Max được Fal tối ưu, đạt tốc độ tạo video siêu thời gian thực

Some milestones move a leaderboard. A rare few change how you see the future. MiniMax H3 Max did bo…

DịchMiniMax ra mắt mô hình nguồn mở H3, được Fal tinh chỉnh thành H3 Max với khả năng tạo video vượt tốc độ thời gian thực, đánh dấu bước tiến mới trong việc phổ cập công nghệ AI tiên tiến cho cộng đồng.

29/08

Thứ Bảy · 3 tin
MarkTechPost
Hướng dẫnĐiểm AI 67/100

Cùng sự kiệnGoogle ra mắt Gemini Omni 1.1 Flash: Mở rộng video 40 giây, kiểm soát khung hình và nâng cấp 4K

Google cập nhật Gemini Omni 1.1 Flash với khả năng mở rộng video lên 40 giây, kiểm soát khung hình đầu-cuối và hỗ trợ xuất 4K. Tốc độ tạo bản nháp tăng 60% với chi phí tối ưu, hiện đã được tích hợp vào các nền tảng như Adobe và Runway.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
Sky Computing Lab@haoailab
Mô hìnhĐiểm AI 48/100

Cùng sự kiệnMiniMax ra mắt FastH3 v1: Tạo video 768p dài 15 giây chỉ trong 13 giây

(1/6) Open Weight @MiniMax_AI FastH3 v1: Generate 15s 768p video in 13s 🚀 - FastVideo collab w/ @nu…

DịchMiniMax hợp tác cùng NVIDIA và FastGen phát hành mã nguồn mở FastH3 v1, đạt tốc độ tạo video nhanh gấp 14 lần trên GPU Blackwell. Dự án này đánh dấu bước tiến mới cho cộng đồng trong việc tối ưu hóa hiệu suất và chất lượng mô hình video.

Cùng sự kiện, bài đại diện «FastVideo ra mắt FastH3: Tạo video 15 giây chỉ trong 13 giây, nhanh gấp 14 lần»

28/08

Thứ Sáu · 5 tin
Alibaba Cloud@alibaba_cloud
Hướng dẫnĐiểm AI 25/100

Quy trình thực chiến với Alibaba Wanx 3.0: Từ ý tưởng đến sản phẩm hoàn thiện

How do creators actually use Wan3.0 in real projects - beyond pressing generate? We sat down with L…

DịchKhám phá cách các nhà sáng tạo ứng dụng Wanx 3.0 vào quy trình làm việc thực tế, từ xây dựng concept đến triển khai dự án chuyên nghiệp thay vì chỉ tạo ảnh đơn thuần.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 58/100

PAWBench: Đánh giá khả năng mô phỏng thế giới thực của các mô hình tạo video

PAWBench là bộ tiêu chuẩn mới giúp kiểm tra xem các mô hình tạo video có thể tái tạo chính xác phân phối xác suất của hành vi vật lý hay không, thay vì chỉ tạo ra các video đơn lẻ hợp lý. Kết quả cho thấy các mô hình hiện nay vẫn chưa đạt được độ chính xác cần thiết.

Alibaba Cloud@alibaba_cloud
Hướng dẫnĐiểm AI 39/100

Cùng sự kiệnAlibaba Cloud Wan3.0 thống trị bảng xếp hạng Video Edit Arena

Wan3.0 takes the #1 spot in the Video Edit Arena by https://Arena.ai. 🥇 See the latest results belo…

DịchMô hình Wan3.0 của Alibaba Cloud vừa vươn lên dẫn đầu Video Edit Arena với 1414 điểm, vượt qua các đối thủ mạnh như Dreamina và MiniMax. Hiện người dùng đã có thể trải nghiệm model này thông qua API trên Model Studio và Qwen Cloud.

Cùng sự kiện, bài đại diện «Qwen3.8-27B thống trị bảng xếp hạng mã nguồn mở về chuyển đổi hình ảnh sang web»
MiniMax@MiniMax_AI
Mô hìnhĐiểm AI 52/100

MiniMax công bố mô hình H3: H3 Max thống trị bảng xếp hạng video AI với tốc độ vượt trội

Congrats to the fal team on MiniMax H3 Max - fantastic work! A quick note on what's actually happen…

DịchMô hình H3 Max (dựa trên nền tảng H3 của MiniMax) vừa đạt vị trí dẫn đầu về chất lượng video và khả năng hiểu prompt. Nhờ tối ưu hóa SGLang và Sol-Attention, mô hình đạt tốc độ tạo video 5 giây chỉ trong dưới 3 giây, nhanh gấp 3,95 lần so với thông thường.

LMSYS: Blog (nhóm Chatbot Arena)
Nghiên cứuĐiểm AI 65/100

Tinh chọnMiniMax-H3 trên 8x H200: Tăng tốc không mất dữ liệu lên tới 1,95 lần

Nhóm SGLang Diffusion thử nghiệm MiniMax-H3 trên 8 GPU NVIDIA H200, đạt tốc độ nhanh gấp 1,95 lần so với Diffusers mà không làm giảm chất lượng hình ảnh.


Vì sao đáng đọc: Đây là bước tiến kỹ thuật quan trọng trong tối ưu hóa suy luận video, cung cấp số liệu thực tế cho các nhà phát triển AI về hiệu năng phần cứng cao cấp.

27/08

Thứ Năm · 5 tin
Google AI@GoogleAI
Mô hìnhĐiểm AI 61/100

Cùng sự kiệnGoogle ra mắt Gemini 1.1 Flash: Bước tiến đột phá trong mở rộng bối cảnh video

Meet Gemini Omni 1.1 Flash ⚡️ Our newest multimodal model for video generation and editing. It now f…

DịchGoogle giới thiệu mô hình Gemini 1.1 Flash với khả năng mở rộng video dựa trên 10 giây ngữ cảnh, vượt xa giới hạn 1 giây của Veo, giúp duy trì tính nhất quán và kể chuyện dài hơi hơn.

Cùng sự kiện, tinh chọn hiển thị «Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI»
Google DeepMind: Blog
Mô hìnhĐiểm AI 70/100

Tinh chọnGoogle ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI

Google giới thiệu Gemini 1.1 Flash với khả năng kiểm soát video nâng cao, hỗ trợ mở rộng bối cảnh lên tới 40 giây, tạo chuyển cảnh mượt mà và xuất video độ phân giải 4K cho nhà phát triển.

Diễn biến sự kiện · 9 bài →Thêm 10 nguồn khác đưa tinMarkTechPostX: Google DeepMind (@GoogleDeepMind)X: Google AI (@GoogleAI)JiqizhixinIT HomeX: Gemini (@GeminiApp)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)The Decoder: AI NewsX: Logan Kilpatrick (@OfficialLoganK)X: Testing Catalog (@testingcatalog)

Vì sao đáng đọc: Cập nhật quan trọng về công cụ cho nhà phát triển, mở rộng khả năng xử lý video vốn là điểm nóng trong lĩnh vực AI tạo sinh hiện nay.
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 40/100

Google sắp ra mắt mô hình video Omni 1.1 Flash với độ phân giải lên tới 4K

GOOGLE 🔥: Omni 1.1 Flash video model is being released with 1080p and 4K output resolution options….

DịchGoogle chuẩn bị trình làng Omni 1.1 Flash, mô hình tạo video mới hỗ trợ xuất hình ảnh sắc nét ở độ phân giải 1080p và 4K, hứa hẹn nâng tầm chất lượng nội dung AI.

26/08

Thứ Tư · 9 tin
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 45/100

Alibaba Cloud ra mắt Wan 3.0 trên Media.io: Tạo phim AI chuyên nghiệp qua API

Wan 3.0 is now live on @mediaioofficial! 🎬 From one idea to a complete AI story-with consistent cha…

DịchAlibaba Cloud chính thức đưa mô hình Wan 3.0 lên nền tảng Media.io, cho phép tạo video từ kịch bản với tính nhất quán cao về nhân vật và bối cảnh. Dịch vụ hiện đã mở API thông qua Model Studio và Qwen Cloud.

Alibaba Cloud@alibaba_cloud
Sản phẩmĐiểm AI 36/100

Cùng sự kiệnAlibaba Cloud ra mắt Wan 3.0: Biến tài liệu kỹ thuật thành video giải thích chỉ trong 30 giây

Wan3.0 for Deep-Dive Explainers Dense, technical documents rarely get read the way they deserve to …

DịchWan 3.0 cho phép chuyển đổi các tệp tài liệu như DOC, XLS, TXT hay MD thành video giải thích chuyên nghiệp dài 30 giây, giúp việc tiếp nhận thông tin phức tạp trở nên dễ dàng và trực quan hơn.

Cùng sự kiện, bài đại diện «Alibaba Cloud ra mắt Wan3.0 trên nền tảng fal: Tạo video 30 giây chỉ trong một lần xuất»
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

OraRL: Tối ưu hóa học tăng cường hiệu quả cho mô hình ngôn ngữ đa phương thức video

Nghiên cứu giới thiệu OraRL, phương pháp mới tận dụng dữ liệu chú giải làm 'oracle rollout' để cải thiện hiệu suất học tăng cường cho mô hình MLLM video, giải quyết vấn đề đảo ngược lợi thế trong quá trình huấn luyện.

Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 40/100

Alibaba Cloud ra mắt Wan 3.0 trên Flaq AI: Đột phá tạo video chất lượng điện ảnh

Wan 3.0 is now available on @aiflaq. Built for cinematic visuals and high-quality video generation. …

DịchMô hình Wan 3.0 của Alibaba Cloud đã có mặt trên Flaq AI, mang đến khả năng tạo video chất lượng điện ảnh với chi phí tối ưu. Người dùng hiện có thể trải nghiệm qua API trên Model Studio và Qwen Cloud.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (81 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Video AI” — Trang 3 | AIHOT.vn