Tháng 5 có 20 sự kiện AI đáng chú ý
Làn sóng tối ưu hóa phần cứng và mô hình AI nhỏ gọn bùng nổ
Tuần qua chứng kiến sự chuyển dịch mạnh mẽ sang các mô hình AI nhỏ gọn, hiệu năng cao trên thiết bị di động cùng những đột phá trong tối ưu hóa hạ tầng suy luận từ Google, NVIDIA và các đối tác. Trong khi các tập đoàn lớn đẩy mạnh đầu tư vào trung tâm dữ liệu và chip chuyên dụng, cộng đồng công nghệ cũng đối mặt với những thách thức về chi phí vận hành và rủi ro an ninh mạng ngày càng phức tạp. Sự kết hợp giữa các công cụ lập trình mới và khả năng tự cải tiến của AI đang mở ra kỷ nguyên phát triển ứng dụng thông minh, linh hoạt và tiết kiệm tài nguyên hơn.
- Phát hành / cập nhật mô hình
Ra mắt Ring-2.6-1T: Mô hình tư duy nghìn tỷ tham số cho các tác vụ phức tạp
Ring-2.6-1T là mô hình tư duy quy mô lớn, được tối ưu hóa cho các tác vụ thực tế với khả năng điều chỉnh độ sâu tư duy linh hoạt và hiệu suất ổn định.
- Phát hành / cập nhật mô hình
SenseNova-U1 ra mắt LoRA chưng cất 8 bước, tăng tốc độ suy luận đáng kể
SenseNova-U1 cập nhật tính năng chưng cất LoRA 8 bước, giảm NFE từ 100 xuống 8, giúp rút ngắn thời gian suy luận trên H100 từ 23 giây xuống còn 2 giây. Đồng thời, dự án hiện đã hỗ trợ ComfyUI với các quy trình làm việc sẵn có cho chỉnh sửa hình ảnh và tạo nội dung.
- Phát hành / cập nhật mô hình
Google chính thức ra mắt Nano Banana Pro và Nano Banana 2
Google vừa phát hành bộ đôi mô hình Nano Banana Pro và Nano Banana 2 thông qua Gemini API, sẵn sàng cho các ứng dụng thực tế. Người dùng có thể khám phá các ví dụ từ cộng đồng để thấy rõ sức mạnh của hai mô hình này.
- Phát hành / cập nhật mô hình
Google ra mắt mô hình đa phương thức Gemini Omni
Gemini Omni là mô hình mới có khả năng tạo nội dung từ bất kỳ đầu vào nào, bắt đầu với video. Người dùng có thể kết hợp hình ảnh, văn bản và video để tạo ra các video chất lượng cao dựa trên kiến thức thực tế của Gemini.
- Phát hành / cập nhật mô hình
OpenAI ra mắt tính năng dịch thuật thời gian thực trên kính thông minh
OpenAI giới thiệu công cụ dịch thuật giọng nói thời gian thực, hỗ trợ hơn 70 ngôn ngữ đầu vào và 13 ngôn ngữ đầu ra, hiện đang được thử nghiệm trên kính thông minh.
- Phát hành / cập nhật mô hình
Anthropic ra mắt mô hình Claude Opus 4.8 mới
Anthropic vừa công bố phiên bản Claude Opus 4.8. Hiện tại, các thông số kỹ thuật chi tiết, hiệu năng và giá cả vẫn chưa được công bố chính thức.
- Phát hành / cập nhật mô hình
Google ra mắt AlphaProof Nexus: Giải mã thành công 2 bài toán hóc búa tồn tại 56 năm
Hệ thống AI mới AlphaProof Nexus của Google đã chứng minh khả năng tư duy logic vượt trội khi giải quyết thành công hai bài toán toán học khó vốn bị bỏ ngỏ suốt 56 năm qua.
- Phát hành / cập nhật mô hình
ModelMind và Đại học Thanh Hoa ra mắt BitCPM-CANN: Mô hình 1.58-bit đầu tiên tại Trung Quốc chạy trên chip Huawei Ascend
ModelMind phối hợp cùng Đại học Thanh Hoa giới thiệu BitCPM-CANN, mô hình ngôn ngữ lớn 1.58-bit tối ưu cho thiết bị đầu cuối, đánh dấu bước tiến quan trọng trong việc chạy AI trên nền tảng phần cứng Huawei Ascend.
- Phát hành / cập nhật mô hình
Ra mắt BitCPM-CANN: Mô hình 1.58-bit đầu tiên huấn luyện toàn diện trên chip Huawei Ascend 910B
Sự kết hợp giữa ModelBest, Đại học Thanh Hoa và OpenBMB đã tạo ra mô hình 1.58-bit tối ưu hóa cho thiết bị biên, giúp giảm bộ nhớ đáng kể mà vẫn duy trì hiệu suất cao.
- Phát hành / cập nhật mô hình
Ra mắt Aleph 2.0 và Edit Studio
Runway chính thức phát hành Aleph 2.0 cùng công cụ Edit Studio, mang đến nền tảng tích hợp toàn diện từ tạo nội dung, chỉnh sửa đến hậu kỳ.
- Sản phẩm / ứng dụng
Runway Agent hỗ trợ tạo quảng cáo hoàn chỉnh chỉ với một cú nhấp chuột
Runway Agent cho phép người dùng chuyển đổi từ ý tưởng và hình ảnh sản phẩm thành một video quảng cáo hoàn chỉnh chỉ trong một phiên làm việc duy nhất.
- Sản phẩm / ứng dụng
Sam Altman: OpenAI muốn dẫn đầu thế giới trong lĩnh vực phòng thủ sinh học
Sam Altman khẳng định OpenAI đang tập trung phát triển các giải pháp AI nhằm giúp thế giới chủ động ứng phó và ngăn chặn sớm các mối đe dọa sinh học tiềm ẩn.
- Tín hiệu ngành
Anthropic huy động thành công 65 tỷ USD vòng Series H, định giá đạt 965 tỷ USD
Anthropic vừa gọi vốn thành công 65 tỷ USD, nâng mức định giá lên 965 tỷ USD nhờ đà tăng trưởng mạnh mẽ của dòng mô hình Claude với doanh thu hàng năm vượt 47 tỷ USD.
- Sản phẩm / ứng dụng
Runway ra mắt máy chủ MCP: Tích hợp trực tiếp AI tạo video vào Claude, Cursor và ChatGPT
Runway vừa giới thiệu máy chủ MCP, cho phép các AI như Claude hay Cursor tạo video và hình ảnh trực tiếp từ giao diện chat mà không cần chuyển đổi ứng dụng. Người dùng có thể truy cập các mô hình mạnh mẽ nhất của Runway như Gen-4.5 và Kling 3.0 chỉ bằng cách đăng nhập tài khoản.
- Sản phẩm / ứng dụng
Luma AI ra mắt Agents: Tạo quảng cáo phong cách UGC chân thực ở quy mô lớn
Luma Agents cho phép người dùng tạo hàng loạt quảng cáo mang phong cách UGC (nội dung do người dùng tạo) một cách chân thực chỉ bằng cách cung cấp tóm tắt và định hướng phong cách, giúp tối ưu hóa quy trình sản xuất nội dung quảng cáo.
- Sản phẩm / ứng dụng
Ra mắt StepAudio 2.5: Trải nghiệm giọng nói thời gian thực với khả năng cảm nhận cảm xúc
Mô hình StepAudio 2.5 có khả năng hiểu sâu sắc ngữ điệu, tốc độ và cảm xúc trong giọng nói của người dùng, đồng thời hỗ trợ tùy chỉnh cá tính nhân vật thông qua API.
- Sản phẩm / ứng dụng
Alibaba Cloud ra mắt mô hình tạo video HappyHorse
Kỷ nguyên AI điện ảnh đã đến. HappyHorse hiện đã có mặt trên Model Studio, cho phép tạo video 1080p chân thực từ câu lệnh trong một quy trình làm việc thống nhất với hiệu suất cao.
- Sản phẩm / ứng dụng
Tính năng tạo ảnh Grok Imagine chính thức ra mắt
Grok Imagine hiện đã khả dụng cho tất cả người dùng, cho phép tạo ra các hình ảnh chất lượng cao, chân thực với nhiều tỷ lệ khung hình khác nhau ngay trên nền tảng X.
- Sản phẩm / ứng dụng
Công nghệ sao chép giọng nói ra mắt: Thật giả khó phân
Hai giọng nói, một từ con người và một từ AI. Bạn có thể đoán được đâu là giọng do AI sao chép không? Tính năng sao chép giọng nói với cảm xúc tự nhiên phong phú hiện đã có mặt trên Grok Voice API.
- Sản phẩm / ứng dụng
Xây dựng tác nhân video thời gian thực từ một hình ảnh duy nhất: Phân tích kỹ thuật Runway Characters
Runway ra mắt 'Characters', tác nhân video thời gian thực có khả năng biến bất kỳ hình ảnh tĩnh nào thành nhân vật video có biểu cảm và giọng nói tự nhiên. Công nghệ này dựa trên mô hình thế giới GWM-1, đạt độ trễ máy chủ cực thấp chỉ 1,75 giây.
Các kỳ nguyệt báo trước
- 2026-08Tháng 8Cuộc chiến bản quyền, sự trỗi dậy của AI Agent và tiến bộ mô hình mới
- 2026-07Tháng 7Bước tiến đột phá của AI trong robot học, tối ưu hóa hiệu năng và nghiên cứu khoa học
- 2026-06Tháng 6Sự bùng nổ mô hình AI quy mô lớn và những thách thức về an ninh, hạ tầng
- 2026-04Tháng 4Hệ sinh thái AI bùng nổ với hạ tầng mạnh mẽ và các mô hình tối ưu