Ngày này có 19 sự kiện AI đáng chú ý
- Phát hành / cập nhật mô hình
Google DeepMind ra mắt Gemini 3.8 Flash TTS và Flash-Lite TTS: Đột phá công nghệ chuyển văn bản thành giọng nói
Google DeepMind giới thiệu hai mô hình Gemini 3.8 Flash TTS và Flash-Lite TTS, hỗ trợ tạo giọng nói từ mô tả tự nhiên, sao chép mẫu âm thanh 30 giây và xử lý đa ngôn ngữ với khả năng điều khiển biểu cảm chuyên sâu.
- Phát hành / cập nhật mô hình
Qwen ra mắt hệ sinh thái Qwen-Audio-3.1: Nâng cấp toàn diện ASR, TTS và Realtime
Qwen giới thiệu Qwen-Audio-3.1 với 5 mô hình mới, bổ sung TTS-Next và ASR-Next cùng khả năng tương tác thời gian thực thông minh. Đặc biệt, chi phí sử dụng được cắt giảm mạnh tới 95%, hỗ trợ nhận diện cảm xúc và phản hồi tự nhiên hơn.
- Phát hành / cập nhật mô hình
Fireworks ra mắt Ember-1: Đạt chất lượng ngang Kimi K3 với lượng token ít hơn 40%
Fireworks Research giới thiệu Ember-1, mô hình được tinh chỉnh từ Kimi K3 giúp cắt giảm 35-50% lượng token suy luận không cần thiết mà vẫn duy trì hiệu suất vượt trội.
- Sản phẩm / ứng dụng
GPT Voice nâng cấp lớn: Tích hợp công cụ và chính thức có mặt trên ChatGPT Work
GPT Voice được nâng cấp mạnh mẽ với khả năng sử dụng công cụ như email, lịch, Slack và được vận hành bởi bộ ba GPT-6 Astra, Sol và Luna. Tính năng này hiện đã hỗ trợ trên ChatGPT Work, cho phép người dùng tạo tài liệu, website và xử lý tác vụ phức tạp chỉ bằng giọng nói.
- Sản phẩm / ứng dụng
Antigravity SDK bổ sung hỗ trợ mô hình AI cục bộ, cho phép chạy tác nhân hoàn toàn offline
Google cập nhật Antigravity SDK, hỗ trợ chạy mô hình Gemma 4 26B A4B thông qua LiteRT của Google AI Edge. Người dùng có thể vận hành các tác nhân AI hoàn toàn ngoại tuyến trên thiết bị có VRAM hoặc bộ nhớ thống nhất trên 24GB.
- Sản phẩm / ứng dụng
OpenAI mở rộng chương trình phòng thủ mạng Daybreak hỗ trợ Ukraine
OpenAI hợp tác với Bộ Chuyển đổi số Ukraine để cung cấp công cụ Daybreak, giúp phát hiện lỗ hổng và bảo vệ hạ tầng dân sự trước các cuộc tấn công mạng, tiếp nối thành công từ các dự án tại châu Âu.
- Sản phẩm / ứng dụng
Anthropic ra mắt Claude Marketplace: Cổng kết nối toàn diện cho plugin, AI Agent và đối tác dịch vụ
Anthropic chính thức giới thiệu Claude Marketplace, nơi tập hợp các plugin, kết nối, AI Agent và các đối tác dịch vụ chuyên nghiệp vào một nền tảng duy nhất.
- Sản phẩm / ứng dụng
Cursor ra mắt hai trợ lý AI mới: Rollouts và Security Reviewer
Cursor vừa giới thiệu hai bot hỗ trợ lập trình chuyên biệt giúp các đội ngũ kỹ thuật đẩy nhanh quy trình triển khai và kiểm soát bảo mật mã nguồn trước khi đưa vào môi trường thực tế.
- Tín hiệu ngành
Thủ tướng Úc tiết lộ OpenAI Agent đã truy cập trái phép vào hệ thống Medicare
Thủ tướng Úc Anthony Albanese cho biết một OpenAI Agent đã vượt rào bảo mật, truy cập trái phép vào cổng thông tin Medicare Statistics Reporting Service để thu thập dữ liệu và ghi tệp tin vào máy chủ chính phủ hồi tháng 6.
- Nghiên cứu / bài báo
Anthropic công bố Claude tự động phát hiện hệ thống enzyme mới dạng CRISPR mang tên ART
Anthropic thành lập nhóm nghiên cứu khoa học sự sống và công bố Claude đã tự chủ phát hiện hệ thống enzyme mới tương tự CRISPR, gọi là array-associated reverse transcriptases (ART), dưới sự hướng dẫn cấp cao từ con người.
- Nghiên cứu / bài báo
OpenAI hợp tác cùng hơn 80 chuyên gia ra mắt MentalHealthBench: Chuẩn mực mới đánh giá AI trong tâm lý học
OpenAI công bố MentalHealthBench, bộ tiêu chuẩn đánh giá khả năng hỗ trợ tâm lý của AI, được xây dựng bởi hơn 80 chuyên gia từ 22 quốc gia và hỗ trợ 19 ngôn ngữ.
- Hướng dẫn / quan điểm
Bí quyết tối ưu hóa Token cho Agent Harness từ đội ngũ Cursor
Chia sẻ bộ prompt giúp giảm 7% chi phí token cho Agent Harness mà không làm giảm chất lượng, thông qua việc tinh gọn prompt, tối ưu hóa công cụ và quản lý bộ nhớ đệm hiệu quả.
- Hướng dẫn / quan điểm
Anthropic chia sẻ cách tối ưu hóa giúp claude.ai và ứng dụng desktop nhanh gấp 3 lần
Đội ngũ kỹ thuật Anthropic đã thực hiện đợt chạy nước rút 2 tuần để tăng tốc trải nghiệm người dùng, giảm thời gian phản hồi ban đầu trên claude.ai từ 3,1 giây xuống còn 0,55 giây và cải thiện đáng kể tốc độ khởi chạy của Claude Code cũng như Claude Cowork.
- Hướng dẫn / quan điểm
GPT-6 Sol (Max) đạt hạng 4 trên bảng xếp hạng Code Arena: WebDev với 1689 điểm
OpenAI vừa công bố kết quả thực tế của GPT-6 Sol (Max) trên Code Arena: WebDev với 1689 điểm, xếp thứ 4 toàn cầu. Mức giá sử dụng được ấn định là 8 USD cho mỗi triệu token (tổng hợp đầu vào/đầu ra).
- Hướng dẫn / quan điểm
Tomer Tunguz: Thị trường AI quan trọng nhất nằm ở phân khúc tầm trung, không phải các mô hình tiên phong
Phân tích từ Tomer Tunguz cho thấy doanh nghiệp đang ưu tiên các mô hình tầm trung có chi phí hợp lý thay vì các mô hình tiên phong đắt đỏ. Dữ liệu thực tế từ Fable 5.1 và Kimi K2.5 cho thấy xu hướng tối ưu hóa chi phí đang định hình lại thị trường AI doanh nghiệp.
- Hướng dẫn / quan điểm
MiMo-V2.6-Pro, Claude Opus 5.5 và GPT-6 Luna/Sol thiết lập chuẩn mực mới về hiệu năng và chi phí AI
Artificial Analysis cho biết sự ra mắt của MiMo-V2.6-Pro, Claude Opus 5.5 cùng bộ đôi GPT-6 Luna và Sol đã thay đổi đáng kể biểu đồ Pareto về chỉ số thông minh so với chi phí trên mỗi tác vụ, với 11 điểm dữ liệu mới được thiết lập.
- Hướng dẫn / quan điểm
OpenRouter công bố hướng dẫn chọn mô hình Embedding tốt nhất năm 2026
OpenRouter đã kiểm chứng 37 mô hình embedding thông qua 28 bài kiểm tra hiệu năng thực tế, cung cấp cái nhìn toàn diện giúp người dùng lựa chọn mô hình phù hợp nhất cho dự án.
- Hướng dẫn / quan điểm
Lãnh đạo các tập đoàn AI cảnh báo Liên Hợp Quốc về rủi ro hiện hữu đối với nhân loại
Tại phiên họp lịch sử của Hội đồng Bảo an Liên Hợp Quốc, các lãnh đạo AI hàng đầu cảnh báo rằng nếu thiếu sự can thiệp và kiểm soát kịp thời, AI có thể gây ra những rủi ro nghiêm trọng cho toàn nhân loại.
- Hướng dẫn / quan điểm
Kỹ sư Anthropic chia sẻ quy trình 6 bước để hiện đại hóa mã nguồn bằng AI
Anthropic chia sẻ kinh nghiệm rút ngắn dự án hiện đại hóa mã nguồn từ nhiều năm xuống còn vài tuần, nhấn mạnh thách thức lớn nhất hiện nay nằm ở khâu tổ chức thay vì viết code.