NVIDIA giới thiệu Jetson Orin Nano 2, dòng máy tính nhúng chuyên dụng giúp các nhà phát triển chạy trực tiếp mô hình AI tạo sinh trên drone và robot mà không cần kết nối trung tâm dữ liệu.
Tựa game hành động Animal Punk từ studio TiGames vừa hé lộ trailer mới tại Gamescom 2026, gây chú ý với công nghệ AI tạo sinh cho phép người chơi tự thiết kế vũ khí và phương tiện ngay trong game.
Nghiên cứu đánh giá toàn diện khoảng cách giữa mô hình thế giới tạo sinh và trình mô phỏng truyền thống qua 8 tiêu chí cốt lõi, dựa trên phân tích 200 công trình tiêu biểu từ 2018 đến 2026.
Nghiên cứu giới thiệu ConceptEdit-12M với 12 triệu cặp ảnh chỉnh sửa chất lượng cao, kết hợp chiến lược giám sát dày đặc giúp AI hiểu sâu hơn về các khái niệm chỉnh sửa tinh vi, khắc phục hạn chế của các mô hình khuếch tán hiện nay.
PixVerse vừa nâng cấp mô hình thế giới thời gian thực lên phiên bản R2, cho phép người dùng tương tác trực tiếp và thay đổi nội dung video theo ý muốn, mở ra kỷ nguyên mới cho giải trí tương tác trực tuyến.
14 days. Unlimited building. ⚡ From Aug 24-Sep 6, get unlimited access to MiniMax M3 and M2.7 on @g…
DịchTừ 24/8 đến 6/9, người dùng có thể trải nghiệm không giới hạn các mô hình MiniMax M3, M2.7 cùng công cụ Speech 2.8 và Music 3.0 trên nền tảng GMI Cloud.
Wan3.0 is now available on @AskVenice. Your ideas stay yours. Go create ↓ More API access: • Model…
DịchMô hình Wan 3.0 của Alibaba Cloud hiện đã có mặt trên nền tảng Venice, cho phép người dùng sáng tạo nội dung với quyền sở hữu hoàn toàn. Người dùng có thể truy cập thông qua API tại Model Studio hoặc Qwen Cloud.
This is Wan3.0. Simple Input. Smart Creation. Where Imagination Meets Reality. Wan3.0 is now general…
DịchAlibaba Cloud vừa phát hành Wan 3.0, mô hình AI hỗ trợ chuyển đổi văn bản thành nội dung sáng tạo. Người dùng có thể nhận ưu đãi giảm giá 30% khi đăng ký gói tiêu chuẩn trên nền tảng Bailian và Tongyi Qianwen từ nay đến hết ngày 23/9.
Người chơi phát hiện nhiều hình ảnh trong bản thử nghiệm Modern Warfare 4 có dấu hiệu của AI tạo sinh, làm dấy lên làn sóng chỉ trích Activision về việc cắt giảm nhân sự nghệ thuật. Dù hãng xác nhận có dùng AI hỗ trợ, nhưng chưa làm rõ các tác phẩm cụ thể này có phải do AI tạo ra hay không.
Ba công ty công nghệ Trung Quốc hợp tác phát triển SpaceClaw, dự án robot vũ trụ tích hợp trí tuệ nhân tạo nguồn mở đầu tiên trên thế giới, nhằm thay thế phương thức điều khiển từ xa truyền thống bằng khả năng tự chủ thông minh.
Vì sao đáng đọc: Tin tức mang tính đột phá khi kết hợp AI tạo sinh với công nghệ hàng không vũ trụ, mở ra hướng đi mới cho robot tự hành trong môi trường không trọng lực.
AI tạo sinh đang rút ngắn quy trình thiết kế, buộc các nhà thiết kế phải chuyển dịch từ việc thực thi kỹ thuật sang tư duy chiến lược, ra quyết định sản phẩm và kiểm chứng kết quả thực tế.
Vì sao đáng đọc: Bài viết cung cấp góc nhìn chuyên sâu từ lãnh đạo thiết kế tại OpenAI về sự thay đổi vai trò của designer trong kỷ nguyên AI, rất hữu ích cho người làm sản phẩm.
Mô hình AI hiện thân 'Hành Giả' của UBTECH đã chính thức vượt qua quy trình đăng ký dịch vụ AI tạo sinh, đánh dấu bước tiến quan trọng trong việc ứng dụng AI vào robot thực tế tại Trung Quốc.
VA-Judger giải quyết vấn đề thiếu tính nhất quán trong tạo video-âm thanh bằng cách sử dụng tập dữ liệu VAPref-10K, giúp mô hình hiểu rõ hơn về sự đồng bộ ngữ nghĩa và cảm nhận của con người thay vì chỉ tối ưu các chỉ số rời rạc.
SenseNova's full U1.5-Lite release is basically a transition from "how many things can one model do? …
DịchSenseNova giới thiệu U1.5 Lite, mô hình đa phương thức 8B tối ưu hóa khả năng hiểu, tạo và chỉnh sửa hình ảnh trong một kiến trúc duy nhất mà không cần chuyển đổi chuyên gia. Mô hình đạt hiệu suất vượt trội trong việc tuân thủ chỉ dẫn và xử lý văn bản phức tạp, tiệm cận các mô hình thương mại lớn.
SenseNova U1.5 Lite - Sharper. More Controllable. More C…
DịchSenseTime giới thiệu SenseNova U1.5 Lite, mô hình đa phương thức 8B hỗ trợ hiểu, tạo và chỉnh sửa hình ảnh 4K với khả năng xử lý văn bản và bố cục phức tạp vượt trội so với các đối thủ cùng phân khúc.
Meta chính thức phát hành Pocket tại Mỹ, ứng dụng cho phép người dùng tạo các trò chơi tương tác đơn giản thông qua câu lệnh AI và chia sẻ chúng trên nền tảng mạng xã hội.
DịchGrok Build cho phép người dùng không có kinh nghiệm về phần mềm 3D như Blender vẫn có thể tạo ra các bản render iPhone chất lượng cao chỉ trong ngày đầu sử dụng.
DịchOdyssey vừa công bố thông tin về mô hình AI mới, tập trung vào khả năng xử lý các trạng thái trung gian trong quá trình tạo nội dung, hứa hẹn mang lại sự linh hoạt cao hơn.
Activision đã xóa bỏ hình ảnh quảng cáo cho Call of Duty: Modern Warfare 4 sau khi người dùng phát hiện lỗi hình ảnh bất thường nghi do AI tạo ra. Hãng giải thích đây chỉ là hình ảnh tạm thời từ tài liệu marketing và không đại diện cho chất lượng đồ họa thực tế trong game.
GS-Voxel giới thiệu khung không gian tiềm ẩn giúp chuyển đổi 3DGS thành các voxel thưa, cho phép tạo hình 3D quy mô lớn từ ảnh vệ tinh mà không cần tối ưu hóa từng cảnh riêng biệt.
From a single prompt to a fully animated parallax landing page. 🤯 See how Gemini 3.7 Flash, combin…
DịchKhám phá cách Gemini 3.7 Flash kết hợp cùng Nano Banana và Omni để tự động hóa quy trình từ ý tưởng đến trang landing page có hiệu ứng Parallax sống động chỉ trong một lần thực thi.
Ngày 17/8, Alibaba chính thức giới thiệu HappyShrimp, mô hình AI âm nhạc mới hứa hẹn giúp người dùng phổ thông dễ dàng tạo ra các bản nhạc chất lượng cao.
GRNEdit giới thiệu khung làm việc hai giai đoạn tối ưu, mô hình hóa chỉnh sửa video dưới dạng quyết định nhị phân. Với chỉ 3% tham số điều kiện, mô hình 2B đã vượt qua nhiều đối thủ 14B, thiết lập chuẩn mực mới về hiệu suất và tính ứng dụng.
SenseTime dự báo chuyển từ khoản lỗ 1,489 tỷ NDT cùng kỳ năm ngoái sang mức lợi nhuận từ 500-700 triệu NDT. Kết quả này phản ánh sự thay đổi chiến lược hiệu quả khi công ty tập trung nguồn lực vào các mô hình nền tảng và AI tạo sinh.
Nghiên cứu đề xuất chiến lược huấn luyện mới bằng cách tận dụng tiền đề từ không gian tiềm ẩn (latent) trước khi chuyển sang không gian pixel, giúp mô hình đạt hiệu suất vượt trội và tăng tốc độ suy luận đáng kể so với các phương pháp truyền thống.
You can win $100, 000 by bringing a scene from Homer's The Odyssey to life with Grok Imagine! SpaceX…
DịchxAI phát động cuộc thi làm phim ngắn dựa trên sử thi Odyssey, yêu cầu sử dụng công cụ Grok Imagine để tạo hình ảnh, video và giọng nói nhân vật với tổng giải thưởng lên tới 100.000 USD.
HiDream.ai vừa trình làng HiDream-O1-World, mô hình thế giới tương tác đầu tiên sử dụng kiến trúc UiT, cho phép người dùng tự do khám phá và thay đổi môi trường ảo với độ nhất quán vật lý cực cao.
Vì sao đáng đọc: Đây là bước tiến quan trọng từ việc 'tạo nội dung' sang 'tạo thế giới tương tác'. Việc đạt top 1 trên bảng xếp hạng WBench khẳng định năng lực kỹ thuật vượt trội của mô hình này.
DịchElon Musk tự hào về sự tiến bộ của Grok khi phiên bản 4.6 có khả năng xem video, tái tạo game và hỗ trợ người dùng không chuyên xây dựng ứng dụng với chi phí cực thấp.
ICYM 👀: Gemini users can now disable visible watermarks for images, videos, and songs. The setting …
DịchNgười dùng Gemini hiện có thể tùy chọn ẩn watermark trên hình ảnh, video và âm thanh. Tuy nhiên, tính năng này sẽ bị khóa tại các quốc gia có quy định pháp lý bắt buộc, và công nghệ nhận diện SynthID vẫn sẽ được duy trì ẩn bên dưới.
Google chuẩn bị cập nhật tính năng Media Watermark trên Gemini, cho phép người dùng ẩn watermark trên ảnh, video và nhạc do AI tạo ra. Dù tắt hiển thị, nội dung vẫn sẽ được bảo mật bằng công nghệ SynthID và siêu dữ liệu C2PA.
Google cập nhật tính năng cho phép loại bỏ hình mờ 'sparkle' trên nội dung do Gemini tạo ra, tuy nhiên các tệp vẫn sẽ chứa mã định danh ẩn SynthID và siêu dữ liệu C2PA để đảm bảo tính minh bạch.
H2R-Bench là bộ tiêu chuẩn mới giúp đánh giá khả năng chuyển đổi video thao tác từ góc nhìn người sang hành động của robot, tập trung vào tính nhất quán về vật lý và kỹ năng thực thi nhiệm vụ.
Turning broken pieces into beautiful narratives. See how Wan 3.0 Beta empowers creators to visualize…
DịchAlibaba Cloud giới thiệu mô hình Wan 3.0 Beta, cho phép người dùng biến các ý tưởng trừu tượng thành video giàu cảm xúc. Công cụ này hiện đã sẵn sàng trải nghiệm trên nền tảng Model Studio và Qwen Cloud.
1/ Wanted to see if you could actually get a usable 3D asset out of a flat 2D image without spending…
DịchHitem3D cho phép tạo mô hình 3D chi tiết từ ảnh 2D chỉ trong 5 phút ngay trên trình duyệt mà không cần cấu hình phức tạp hay chỉnh sửa lưới thủ công.
Grok 4.6 takes the #1 spot on two more benchmarks! 🔥 • 3DCodeBench: 54.0%, creating engine-ready 3…
DịchGrok 4.6 vừa xuất sắc dẫn đầu hai bài kiểm tra mới: đạt 54% trên 3DCodeBench để tạo tài nguyên 3D và 40,9% trên CadGenBench để tạo mô hình CAD từ văn bản.
Twitch vừa cập nhật tính năng cho phép người dùng từ chối việc Amazon sử dụng nội dung kênh để huấn luyện các mô hình AI tạo sinh. Mặc dù đã âm thầm thực hiện việc này suốt hai năm qua, người dùng hiện phải tự tay tắt tùy chọn này trong phần cài đặt bảo mật nếu không muốn tham gia.
Người dùng Twitch hiện có thể tắt tính năng cho phép Amazon sử dụng video, clip và nội dung trò chuyện để huấn luyện các mô hình AI tạo sinh trong tương lai thông qua cài đặt bảo mật.
FLUX 3 is now live in Luma. @bfl_ai 's first general model for image, video, audio, and action-pred…
DịchLuma AI vừa ra mắt FLUX 3, mô hình đa phương thức đầu tiên từ Black Forest Labs hỗ trợ xử lý đồng thời hình ảnh, video, âm thanh và dự đoán chuyển động. Người dùng hiện đã có thể trải nghiệm tính năng tạo video kèm âm thanh gốc ngay trên nền tảng.