Tất cả chủ đề
CHỦ ĐỀ

Video AI

Tạo và hiểu video bằng AI: Mô hình text-to-video, công cụ biên tập video và cuộc cách mạng điện ảnh sáng tạo.

749 bài thu thập40 tinh chọncập nhật đến 27/09 22:00

Tiêu điểm gần đây

14 ngày qua, xếp theo số nguồn độc lập cùng đưa tin
  1. Claude Opus 5.5 tạo video giải thích về đệ quy đầy sáng tạo2 nguồn · 26-09
  2. Claude Opus 5.5 tạo video ngắn phong cách anime chỉ trong một lần thử2 nguồn · 25-09
  3. Runway công bố báo cáo đánh giá hiệu quả chi phí và chất lượng của Model Router2 nguồn · 25-09
  4. Runway ra mắt DIFFUSE: Nền tảng kết nối nhân tài AI chuyên nghiệp2 nguồn · 22-09
  5. Alibaba hé lộ bước tiến mới: Đang huấn luyện Qwen4 và mô hình video thế hệ tiếp theo2 nguồn · 22-09

25/09

Thứ Sáu · 1 tin
Hugging Face Daily Papers
Điểm AI 88/100

Huấn luyện khả năng duy trì vật thể trong các mô hình thế giới (World Models)

Nghiên cứu giới thiệu WROP, bộ dữ liệu gồm 1,5 triệu mẫu mô phỏng nhằm huấn luyện và đánh giá khả năng nhận thức vật lý của 14 mô hình video, tập trung vào khái niệm duy trì vật thể (object permanence) giống con người.


Vì sao đáng đọc: Đề tài nghiên cứu chuyên sâu, giải quyết vấn đề cốt lõi trong việc phát triển trí tuệ nhân tạo có khả năng hiểu vật lý thế giới thực, rất có giá trị cho cộng đồng AI.

24/09

Thứ Năm · 3 tin
WeChat: Volcano Engine
Điểm AI 66/100

Seedance 2.5 ra mắt chế độ Draft: Tạo nháp 480P siêu tốc, xuất bản 1080P chỉ với một cú click

API Seedance 2.5 bổ sung chế độ Draft cho phép người dùng tạo bản nháp 480P để kiểm tra ý tưởng nhanh chóng, sau đó dùng ID bản nháp để xuất file 1080P hoàn chỉnh mà vẫn giữ nguyên các thông số kỹ thuật.


Vì sao đáng đọc: Thông tin chính thức đưa ra các con số tiết kiệm chi phí cụ thể và giải thích quy trình làm việc hai giai đoạn, giúp người sáng tạo xác định xem có nên tích hợp chế độ Draft vào quy trình tạo video của mình hay không.
WeChat: Volcano Engine
Điểm AI 67/100

Hậu Tây Du Ký: Phim dài tập AI đầu tiên lên sóng giờ vàng đài truyền hình Trung Quốc

Bộ phim 'Hậu Tây Du Ký' với 60 tập được sản xuất 100% bằng công cụ Seedance đã lên sóng giờ vàng đài Hồ Nam, đạt hơn 150 triệu lượt xem chỉ sau một tuần nhờ tối ưu chi phí sản xuất vượt trội so với quay phim truyền thống.


Vì sao đáng đọc: Bản tổng kết chính thức cung cấp quy trình sáng tạo và so sánh chi phí từ khâu lập dự án đến khi phát sóng phim dài tập AI, giúp độc giả hiểu rõ phương thức sản xuất thực tế của các tác phẩm tự sự dài hơi bằng AIGC.
Runway: News (Web)
Điểm AI 62/100

Runway ra mắt plugin cho DaVinci Resolve: Tạo và chỉnh sửa video trực tiếp trong phần mềm dựng phim

Runway vừa phát hành plugin cho DaVinci Resolve Studio, cho phép người dùng tạo hình ảnh, video và thực hiện inpainting (vẽ lại) trực tiếp trên timeline mà không cần chuyển đổi ứng dụng.


Vì sao đáng đọc: Đây là bước tiến lớn giúp tối ưu hóa quy trình làm việc cho các nhà làm phim chuyên nghiệp, kết hợp sức mạnh AI của Runway vào công cụ dựng phim tiêu chuẩn ngành.

23/09

Thứ Tư · 1 tin
QbitAI
Điểm AI 88/100

Mô hình thế giới thời gian thực bước vào kỷ nguyên 'toàn năng': PixVerse R2 tiên phong dẫn đầu

PixVerse R2 đánh dấu bước tiến mới khi kết hợp hoàn hảo giữa khả năng phản hồi thời gian thực và tính ứng dụng đa năng, định nghĩa lại tiêu chuẩn cho các mô hình thế giới hiện nay.


Vì sao đáng đọc: Tin tức cập nhật về bước tiến công nghệ quan trọng trong lĩnh vực mô hình thế giới, có tính ứng dụng cao và thu hút sự quan tâm lớn từ cộng đồng AI.

22/09

Thứ Ba · 1 tin
Hugging Face Daily Papers
Điểm AI 88/100

Tại sao mô hình tạo video lại 'phi vật lý'? Giải mã lỗi từ cơ chế Attention

Nghiên cứu chỉ ra rằng các mô hình tạo video hiện nay thường vi phạm quy luật vật lý do lỗi trong cơ chế Attention và sự suy giảm không gian từ RoPE, dẫn đến việc định hình chuyển động sai lệch ngay từ giai đoạn khử nhiễu đầu tiên.


Vì sao đáng đọc: Nghiên cứu chuyên sâu, giải quyết vấn đề cốt lõi của AI tạo video hiện nay. Nội dung có tính học thuật cao, rất hữu ích cho các kỹ sư và nhà nghiên cứu AI.

17/09

Thứ Năm · 1 tin
Hugging Face Daily Papers
Điểm AI 92/100

Zing-0.5: Mô hình thế giới tương tác thời gian thực qua điều khiển văn bản và bàn phím

Zing-0.5 là mô hình thế giới 5B cho phép người dùng khám phá và can thiệp vào các sự kiện đang diễn ra thông qua kết hợp điều khiển bàn phím và văn bản theo thời gian thực với tốc độ 24 FPS.


Vì sao đáng đọc: Bước tiến đột phá trong việc biến mô hình thế giới thành môi trường tương tác thực thụ, giải quyết tốt bài toán độ trễ và tính điều khiển trong AI tạo sinh.

16/09

Thứ Tư · 2 tin
QbitAI
Điểm AI 88/100

Vidu S2 tung ba tính năng đột phá: Tương tác thời gian thực, chỉnh sửa video trực tiếp và hỗ trợ video không gian

Vidu S2 vừa cập nhật ba tính năng mạnh mẽ, cho phép người dùng tương tác trực tiếp, chỉnh sửa video theo thời gian thực và khám phá định dạng video không gian đầy ấn tượng.


Vì sao đáng đọc: Đây là bản cập nhật quan trọng của một mô hình video AI hàng đầu, mang tính ứng dụng cao và bắt kịp xu hướng công nghệ không gian, rất thu hút cộng đồng sáng tạo.
Hugging Face Daily Papers
Điểm AI 92/100

Vidu S2: Bước tiến mới trong tạo video tương tác, chỉnh sửa thời gian thực và không gian 3D

Vidu S2 giới thiệu khả năng tạo avatar kỹ thuật số và chỉnh sửa video thời gian thực với độ phân giải 720p, hỗ trợ thay đổi trang phục, bối cảnh và tạo video không gian linh hoạt.

Thêm 1 nguồn khác đưa tinJiqizhixin
Vì sao đáng đọc: Đây là bước đột phá lớn về tốc độ xử lý video AI, giải quyết được bài toán độ trễ vốn là rào cản lớn nhất hiện nay, có tính ứng dụng thực tế cực cao.

15/09

Thứ Ba · 2 tin
WeChat: ShengShu (Vidu - Video)
Điểm AI 66/100

Vidu S2 ra mắt: Bước tiến mới trong tạo hình Avatar và chỉnh sửa video thời gian thực

Shengshu Technology giới thiệu Vidu S2 với hai mô hình chuyên biệt: Vidu S2-Avatar cho tương tác kỹ thuật số và Vidu S2-Editing cho chỉnh sửa video, đồng thời mở rộng sang lĩnh vực video không gian cho kính VR.


Vì sao đáng đọc: Đây là bản cập nhật quan trọng của một trong những mô hình video AI hàng đầu, tập trung vào tính ứng dụng thực tế như Avatar và VR, rất đáng chú ý với cộng đồng công nghệ.
Hugging Face Daily Papers
Điểm AI 88/100

AlayaVista: Mô hình thế giới video streaming kết hợp toàn cảnh và góc nhìn chi tiết

AlayaVista là mô hình thế giới video mới giúp tách biệt quá trình tiến hóa của bối cảnh toàn cảnh 360 độ với việc tổng hợp hình ảnh góc nhìn chi tiết, cho phép điều khiển camera mượt mà và duy trì độ trung thực cao.


Vì sao đáng đọc: Đột phá trong cách xử lý bối cảnh 360 độ kết hợp với video streaming, giải quyết hiệu quả bài toán đánh đổi giữa tầm nhìn bao quát và độ chi tiết trong mô hình thế giới.

13/09

Chủ Nhật · 1 tin
JiQiZhiXin
Điểm AI 92/100

Tối ưu hóa MiniMax H3 trên vLLM-Omni: Đột phá tốc độ tạo video thời gian thực

Bài viết phân tích cách vLLM-Omni và FastVideo FastH3 giải quyết các nút thắt hệ thống trong MiniMax H3, giúp rút ngắn thời gian tạo video 10 giây xuống dưới 9 giây thông qua tối ưu hóa toàn diện từ DiT đến đóng gói MP4.


Vì sao đáng đọc: Nội dung chuyên sâu về kỹ thuật tối ưu hóa hạ tầng cho mô hình video tạo sinh, giải quyết bài toán thực tế về độ trễ hệ thống, rất có giá trị cho kỹ sư AI.

11/09

Thứ Sáu · 1 tin
QbitAI
Điểm AI 92/100

Đỉnh cao mã nguồn mở: RunningHub giúp MiniMax H3 tăng tốc gấp 12 lần, chạy mượt ngay trên máy cá nhân

RunningHub tối ưu hóa hiệu suất vượt trội, cho phép tạo video 15 giây chỉ trong 50 giây trên MiniMax H3, giúp việc triển khai cục bộ trở nên cực kỳ nhanh chóng.


Vì sao đáng đọc: Tin tức mang tính đột phá về kỹ thuật tối ưu hóa mô hình AI, giải quyết trực tiếp nỗi đau về tốc độ cho người dùng cá nhân và cộng đồng mã nguồn mở.

10/09

Thứ Năm · 2 tin
JiQiZhiXin
Điểm AI 88/100

Ra mắt EchoWM: Mô hình thế giới 'biết nói' từ JD.com, mở ra kỷ nguyên tương tác nghe nhìn chân thực

JD.com vừa công bố và mã nguồn mở JoyAI-EchoWM, mô hình thế giới tiên phong tích hợp âm thanh và hình ảnh, cho phép người dùng khám phá không gian 3D với độ nhất quán cao và phản hồi thời gian thực.


Vì sao đáng đọc: Đây là bước tiến quan trọng của AI nội địa Trung Quốc trong lĩnh vực mô hình thế giới (World Models), kết hợp thành công giữa hình ảnh và âm thanh, có tính ứng dụng cao trong game và VR.
Hugging Face Daily Papers
Điểm AI 92/100

DF26: Khi ranh giới giữa video thật và giả do AI tạo ra đã hoàn toàn bị xóa nhòa

DF26 là bộ dữ liệu chuẩn mới gồm hơn 2.700 video, cho thấy cả con người lẫn các công cụ phát hiện deepfake hiện đại đều gần như bất lực trước các video do AI tạo ra. Nghiên cứu này gióng lên hồi chuông cảnh báo về sự cần thiết của các tiêu chuẩn kiểm chứng mới trong kỷ nguyên AI tạo sinh.


Vì sao đáng đọc: Chủ đề cực kỳ cấp thiết về an ninh mạng và deepfake. Kết quả nghiên cứu gây sốc về khả năng phát hiện của con người tạo tính thời sự cao, thu hút sự quan tâm lớn.

09/09

Thứ Tư · 2 tin
OpenRouter: Announcements
Điểm AI 70/100

Đánh giá Seedance 2.5 từ OpenRouter: Phân tích chi phí và khả năng biên tập video chuyên sâu

OpenRouter đánh giá mô hình video Seedance 2.5 của ByteDance, nổi bật với khả năng tạo video 4-30 giây, hỗ trợ điều khiển khung hình và tích hợp âm thanh không phát sinh thêm phí.


Vì sao đáng đọc: Cung cấp thông tin thực tế về công cụ tạo video mới, phân tích chi phí và tính năng kỹ thuật hữu ích cho người dùng chuyên nghiệp.
Runway: News (Web)
Điểm AI 63/100

Runway ra mắt plugin cho Adobe Premiere Pro và After Effects: Tạo video AI ngay trong timeline

Runway vừa giới thiệu bộ plugin mới cho phép người dùng Premiere Pro và After Effects tạo, chỉnh sửa và render video bằng AI trực tiếp trên timeline mà không cần xuất nhập file thủ công.

Diễn biến sự kiện · 2 bài →
Vì sao đáng đọc: Đây là bước tiến lớn giúp tối ưu hóa quy trình làm việc cho editor chuyên nghiệp, kết hợp sức mạnh AI của Runway vào công cụ dựng phim phổ biến nhất thế giới.

08/09

Thứ Ba · 1 tin
TechNode
Điểm AI 88/100

ByteDance phát triển mô hình video không gian thời gian thực dưới sự chỉ đạo của Zhang Yiming

ByteDance đang gấp rút hoàn thiện mô hình tạo video không gian thời gian thực dựa trên nền tảng Seedance, với sự giám sát trực tiếp từ nhà sáng lập Zhang Yiming. Dự án dự kiến ra mắt sớm nhất vào tháng tới nhằm cạnh tranh trong lĩnh vực nội dung 3D.


Vì sao đáng đọc: Tin tức quan trọng về một ông lớn công nghệ, có sự tham gia trực tiếp của lãnh đạo cấp cao và tác động lớn đến xu hướng video AI tương lai.

07/09

Thứ Hai · 1 tin
Hugging Face Daily Papers
Điểm AI 92/100

EditVid: Khung chỉnh sửa video thống nhất, không cần huấn luyện với độ chính xác vượt trội

EditVid là giải pháp đột phá cho phép chỉnh sửa video đa dạng từ thay đổi phong cách đến chèn đối tượng mà không cần huấn luyện lại mô hình, đạt hiệu suất vượt trội so với các phương pháp hiện có.


Vì sao đáng đọc: Đây là một bước tiến quan trọng trong lĩnh vực xử lý video bằng AI, giải quyết bài toán khó về tính nhất quán và đa năng mà không tốn tài nguyên huấn luyện.

04/09

Thứ Sáu · 2 tin
JiQiZhiXin
Điểm AI 92/100

Đại học Tây Hồ ra mắt Code World Model: Khi mã nguồn định hình sự tiến hóa của thế giới ảo

Nhóm nghiên cứu tại Đại học Tây Hồ giới thiệu Code World Model, mô hình kết hợp Coding Agent để quản lý logic thế giới và mô hình video để hiển thị hình ảnh, giúp thế giới ảo duy trì tính nhất quán và logic dài hạn thay vì chỉ tạo ra các khung hình đơn lẻ.


Vì sao đáng đọc: Đột phá trong cách tiếp cận mô hình thế giới bằng cách tách biệt logic (code) và hình ảnh (video), giải quyết bài toán khó về tính nhất quán trong các môi trường mở.
JiQiZhiXin
Điểm AI 88/100

DeepLeap trình làng mô hình DELE-w0.5: Hướng đi mới cho robot mà không cần tạo video

Startup DeepLeap giới thiệu mô hình thế giới DELE-w0.5, loại bỏ việc tạo video tốn kém để tập trung vào khả năng tái cấu trúc hành vi, giúp robot thích nghi linh hoạt với các tình huống thực tế chưa từng được huấn luyện.


Vì sao đáng đọc: Bài viết giới thiệu một hướng tiếp cận kỹ thuật mới đầy tiềm năng trong lĩnh vực (Embodied AI), giải quyết bài toán hiệu suất cho robot mà không cần dựa vào mô hình tạo video nặng nề.

02/09

Thứ Tư · 1 tin
Google DeepMind: Blog
Điểm AI 71/100

Google DeepMind ra mắt tính năng hiểu video thông minh cho Gemini

Google DeepMind cập nhật khả năng xử lý video thông minh cho dòng Gemini Flash, giúp mô hình tự động quét các phân đoạn quan trọng. Công nghệ này giúp giảm 88% lượng token, tiết kiệm 66% chi phí và tăng 7% độ chính xác so với phương pháp xử lý khung hình cố định truyền thống.

Diễn biến sự kiện · 2 bài →
Vì sao đáng đọc: Đây là bước tiến quan trọng trong tối ưu hóa chi phí và hiệu suất cho AI đa phương thức, có tác động trực tiếp đến người dùng doanh nghiệp và lập trình viên.

01/09

Thứ Ba · 2 tin
QbitAI
Điểm AI 92/100

MiniMax tạo video trong 3 giây: Bước ngoặt thương mại hóa AI thời gian thực

MiniMax vừa ra mắt công nghệ tạo video siêu tốc chỉ trong 3 giây, mở ra tiềm năng ứng dụng thương mại hóa trực tiếp cho các nội dung AI thời gian thực.


Vì sao đáng đọc: Công nghệ tạo video tốc độ cao là bước tiến quan trọng, giải quyết bài toán độ trễ trong sản xuất nội dung, có tính ứng dụng thực tiễn rất cao.
Runway: News (Web)
Điểm AI 67/100

Runway ra mắt Solaris: Mô hình thế giới đầu tiên tạo giao diện tương tác theo thời gian thực

Runway giới thiệu Solaris, mô hình tiên phong trong dòng Interface World Models, cho phép tạo giao diện người dùng theo thời gian thực và phản hồi trực tiếp các thao tác như nhấp chuột hay kéo thả mà không cần thông qua mã nguồn.

Diễn biến sự kiện · 2 bài →
Vì sao đáng đọc: Đây là bước tiến đột phá trong việc kết hợp mô hình thế giới với giao diện người dùng, thay đổi hoàn toàn cách thức tương tác với phần mềm thông qua AI tạo sinh.

31/08

Thứ Hai · 2 tin
JiQiZhiXin
Điểm AI 88/100

Trải nghiệm thực tế: Dùng 'Qwen Creation' tạo phim ngắn AI với dàn Agent chuyên nghiệp

Alibaba vừa ra mắt nền tảng 'Qwen Creation' tích hợp mô hình Wan 3.0 và hệ thống đa Agent, cho phép người dùng tự động hóa quy trình sản xuất video từ kịch bản đến hậu kỳ, giải quyết bài toán nhất quán trong sáng tạo nội dung AI.


Vì sao đáng đọc: Bài viết phân tích sâu sắc về sự chuyển dịch từ việc cải thiện chất lượng mô hình sang tối ưu hóa quy trình sản xuất (workflow), một vấn đề thực tế mà các nhà sáng tạo AI đang đối mặt.
WeChat: MiniMax
Điểm AI 68/100

Ra mắt website livestream AI 24/7 vận hành bởi MiniMax H3 Max

MiniMax đã tích hợp mô hình H3 Max vào nền tảng mở, cho phép các nhà phát triển tạo ra các kênh livestream Twitch và truyền hình AI hoạt động liên tục 24/7.


Vì sao đáng đọc: Tin tức cập nhật về ứng dụng thực tế của mô hình video AI, cho thấy khả năng thương mại hóa và tính ứng dụng cao trong lĩnh vực sáng tạo nội dung.

28/08

Thứ Sáu · 2 tin
JiQiZhiXin
Điểm AI 92/100

ECCV 2026 Oral: MAVIN - Bước tiến mới giúp AI 'đạo diễn' video đa góc quay theo kịch bản

MAVIN là mô hình tiên phong cho phép AI tạo video đa góc quay với khả năng kiểm soát chặt chẽ về thời gian, đồng bộ âm thanh và nhất quán nhân vật, giải quyết bài toán khó trong việc kể chuyện bằng video dài.


Vì sao đáng đọc: Đây là nghiên cứu đột phá được chọn làm Oral tại ECCV 2026, giải quyết trực tiếp điểm yếu của các mô hình video hiện nay là khả năng duy trì tính nhất quán trong kịch bản phức tạp.
LMSYS: Blog (nhóm Chatbot Arena)
Điểm AI 65/100

MiniMax-H3 trên 8x H200: Tăng tốc không mất dữ liệu lên tới 1,95 lần

Nhóm SGLang Diffusion thử nghiệm MiniMax-H3 trên 8 GPU NVIDIA H200, đạt tốc độ nhanh gấp 1,95 lần so với Diffusers mà không làm giảm chất lượng hình ảnh.


Vì sao đáng đọc: Đây là bước tiến kỹ thuật quan trọng trong tối ưu hóa suy luận video, cung cấp số liệu thực tế cho các nhà phát triển AI về hiệu năng phần cứng cao cấp.

27/08

Thứ Năm · 2 tin
Google DeepMind: Blog
Điểm AI 70/100

Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI

Google giới thiệu Gemini 1.1 Flash với khả năng kiểm soát video nâng cao, hỗ trợ mở rộng bối cảnh lên tới 40 giây, tạo chuyển cảnh mượt mà và xuất video độ phân giải 4K cho nhà phát triển.

Diễn biến sự kiện · 9 bài →
Vì sao đáng đọc: Cập nhật quan trọng về công cụ cho nhà phát triển, mở rộng khả năng xử lý video vốn là điểm nóng trong lĩnh vực AI tạo sinh hiện nay.
Hugging Face Daily Papers
Điểm AI 92/100

JoyAI-Echo-1.5: Bước tiến mới trong tạo video dài và thế giới ảo tương tác

JoyAI-Echo-1.5 là hệ thống tạo video và âm thanh đột phá, giúp duy trì tính nhất quán của nhân vật trong các video dài và cho phép tương tác thời gian thực trong môi trường 3D.


Vì sao đáng đọc: Đây là nghiên cứu quan trọng giải quyết bài toán khó về tính nhất quán trong video dài và tương tác thế giới ảo, có tiềm năng ứng dụng lớn trong làm phim và game.
Video AI — Chủ Đề AI | AIHOT.vn