Ngày này có 28 sự kiện AI đáng chú ý
- Phát hành / cập nhật mô hình
ra mắt GLM-5.3-Flash: Mô hình đa phương thức 320B với chi phí chỉ bằng 1/40 Claude Opus
vừa công bố GLM-5.3-Flash, mô hình đa phương thức đầu tiên thuộc dòng GLM-5 với 320 tỷ tham số. Sản phẩm đạt hiệu suất ngang ngửa Claude Opus 4.8 nhưng có giá thành cực kỳ cạnh tranh, hiện đã mở API cho các nhà phát triển.
- Phát hành / cập nhật mô hình
Qwen3.8-Flash-Next: Kiến trúc mới đột phá, tối ưu hóa chi phí vận hành AI
Alibaba ra mắt Qwen3.8-Flash-Next với kiến trúc cải tiến, giúp giảm đáng kể chi phí suy luận mà vẫn duy trì hiệu suất cao, mở đường cho các ứng dụng AI quy mô lớn tiết kiệm hơn.
- Phát hành / cập nhật mô hình
Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực
Google DeepMind vừa trình làng Gemini 3.5 Transcribe, mô hình chuyển đổi giọng nói thành văn bản với độ chính xác vượt trội, hỗ trợ hơn 85 ngôn ngữ, nhận diện đa người nói và tùy chỉnh từ vựng linh hoạt.
- Phát hành / cập nhật mô hình
Tencent Hunyuan nén mô hình dịch thuật Hy-MT2-1.8B xuống còn 440MB, ứng dụng thực tế trên Bilibili
Tencent đã tối ưu hóa mô hình Hy-MT2-1.8B bằng kỹ thuật lượng tử hóa cực thấp, giúp đạt hiệu suất dịch thuật vượt trội trên Bilibili với tốc độ phản hồi chỉ từ 500-800ms.
- Phát hành / cập nhật mô hình
GlucoFM: Mô hình nền tảng từ Google giúp dự báo chỉ số đường huyết liên tục
Google Research giới thiệu GlucoFM, mô hình AI tự giám sát giúp phân tích xu hướng đường huyết dài hạn và biến động ngắn hạn. Với khả năng dự báo chính xác vượt trội so với các giải pháp hiện có, đây là bước tiến lớn trong việc ứng dụng AI vào theo dõi sức khỏe cá nhân.
- Sản phẩm / ứng dụng
Claude chính thức ra mắt tiện ích trình duyệt Chrome cho người dùng trả phí
Anthropic đã phát hành rộng rãi Claude in Chrome, cho phép AI tự động thực hiện các thao tác trên trình duyệt với cơ chế bảo mật nâng cao, giúp ngăn chặn hiệu quả các cuộc tấn công tiêm nhiễm câu lệnh (prompt injection).
- Sản phẩm / ứng dụng
Claude Cowork ra mắt trình duyệt tích hợp: Tự động lướt web và thao tác như người dùng
Ứng dụng Claude Cowork vừa bổ sung trình duyệt tích hợp, cho phép AI tự động điều hướng, đọc nội dung và điền biểu mẫu trên web mà không cần cài đặt thêm. Tính năng này ưu tiên bảo mật bằng cách tách biệt hoàn toàn với trình duyệt cá nhân của người dùng.
- Sản phẩm / ứng dụng
NVIDIA mở rộng NVLink Fusion, ra mắt công nghệ bộ nhớ tùy chỉnh NVHBM
NVIDIA giới thiệu công nghệ NVHBM giúp tăng 30% băng thông và giảm 15% điện năng tiêu thụ so với HBM4E tiêu chuẩn, đồng thời tối ưu hóa diện tích chip xử lý.
- Sản phẩm / ứng dụng
Databricks ra mắt Governance Hub: Giải pháp quản trị thông minh toàn diện cho tài sản dữ liệu
Databricks giới thiệu Governance Hub, cung cấp khả năng quản trị thông minh ở cấp tài khoản, giúp tối ưu hóa chi phí và tăng cường tính minh bạch cho toàn bộ hệ thống dữ liệu của doanh nghiệp.
- Sản phẩm / ứng dụng
Google Cloud tối ưu hóa suy luận Embedding đa phương thức trên Cloud TPU với độ chính xác cấp doanh nghiệp
Google Cloud tích hợp hỗ trợ TPU vào vLLM, tối ưu hóa cho dòng mô hình Qwen3 để xử lý suy luận Embedding đa phương thức với ngữ cảnh dài (4K+ token văn bản, 15K+ token đa phương thức).
- Sản phẩm / ứng dụng
Claude for Word: Biến bản nháp thành tài liệu hoàn chỉnh trong tích tắc
Tính năng mới tích hợp Claude vào Microsoft Word giúp người dùng tự động hóa việc chỉnh sửa, tinh chỉnh văn phong và hoàn thiện tài liệu chuyên nghiệp ngay trong trình soạn thảo.
- Tín hiệu ngành
OpenAI lên tiếng về sự cố Hugging Face và định hướng tương lai
OpenAI chính thức phản hồi về sự cố liên quan đến Hugging Face, nhấn mạnh cam kết cân bằng giữa phát triển AI mở và đảm bảo an toàn hệ thống trong tương lai.
- Tín hiệu ngành
Bê bối: Think tank 'ma' được Israel tài trợ dùng AI thao túng chatbot
Một tổ chức giả danh đã tung ra hàng trăm bài viết được tối ưu hóa bằng AI nhằm thao túng câu trả lời của ChatGPT theo hướng có lợi cho Israel. Đây là chiến dịch truyền thông quy mô lớn được chính phủ Israel tài trợ thông qua các bên trung gian.
- Tín hiệu ngành
Amazon tăng gấp ba đơn hàng chip Nvidia, bổ sung 2 triệu GPU cho hạ tầng AI
Amazon vừa nâng cấp thỏa thuận với Nvidia để bổ sung 2 triệu GPU thế hệ mới cho AWS vào năm 2028, khẳng định nhu cầu hạ tầng AI đang tăng trưởng vượt kỳ vọng.
- Tín hiệu ngành
NVIDIA công bố báo cáo tài chính nửa đầu năm 2027: Lợi nhuận ròng tăng vọt 161,1%
NVIDIA đạt doanh thu 177,8 tỷ USD và lợi nhuận ròng 118 tỷ USD trong nửa đầu năm tài chính 2027. Mảng trung tâm dữ liệu tiếp tục là động lực tăng trưởng chính với doanh thu quý II đạt 89 tỷ USD, đồng thời nền tảng Vera Rubin đã chính thức bước vào giai đoạn sản xuất hàng loạt.
- Tín hiệu ngành
Linear huy động thành công 99 triệu USD, định giá đạt 2,5 tỷ USD
Nền tảng quản lý dự án Linear vừa hoàn tất đợt chào mua 99 triệu USD với định giá 2,5 tỷ USD. Công ty ghi nhận doanh thu định kỳ hàng năm vượt 100 triệu USD, với 50% khối lượng công việc hiện được xử lý bởi các tác nhân AI.
- Tín hiệu ngành
OpenAI mở rộng ChatGPT cho giáo viên tới 55 học khu tại Mỹ, hỗ trợ hơn 100.000 nhà giáo
OpenAI mở rộng chương trình ChatGPT for Teachers đến 55 học khu mới tại Mỹ, cung cấp quyền truy cập miễn phí và đào tạo cho hơn 300.000 giáo viên cùng cam kết bảo mật dữ liệu nghiêm ngặt đến năm 2028.
- Nghiên cứu / bài báo
Tiêu chuẩn xác thực ảnh C2PA trên Android bị vô hiệu hóa bởi lỗ hổng root
Nghiên cứu mới chỉ ra rằng kẻ tấn công có quyền root trên Android có thể giả mạo chữ ký C2PA bằng cách lợi dụng StrongBox, khiến tính xác thực của ảnh và video bị đe dọa nghiêm trọng.
- Nghiên cứu / bài báo
Anthropic chia sẻ dữ liệu thực tế của Claude cho các tổ chức nghiên cứu độc lập
Anthropic đã cung cấp 250.000 đoạn hội thoại từ Claude cho các viện nghiên cứu tại Stanford, Oxford và METR thông qua công cụ bảo mật Anthropic Insights để phục vụ các nghiên cứu độc lập.
- Nghiên cứu / bài báo
Báo cáo mới từ OpenAI: ChatGPT phá vỡ giới hạn thời gian trong học tập
OpenAI công bố báo cáo về cách ChatGPT hỗ trợ giáo viên và học sinh mở rộng việc học ngoài lớp học, với hàng trăm triệu lượt truy vấn liên quan đến học thuật mỗi tuần ngay cả trong kỳ nghỉ hè.
- Nghiên cứu / bài báo
IDEA Prune: Apple tối ưu hóa hiệu suất mô hình ngôn ngữ bằng quy trình 'Mở rộng rồi Cắt tỉa'
Apple giới thiệu IDEA Prune, một quy trình kết hợp việc huấn luyện mô hình lớn trước khi cắt tỉa để tối ưu hóa hiệu quả sử dụng token, giúp đạt hiệu suất cao hơn so với việc huấn luyện mô hình kích thước mục tiêu ngay từ đầu.
- Nghiên cứu / bài báo
PROOF-Gen: Tối ưu hóa dữ liệu để nâng cao hiệu quả chưng cất tri thức trong gọi công cụ
PROOF-Gen cải thiện khả năng gọi công cụ của mô hình nhỏ bằng cách tận dụng các tín hiệu thất bại từ mô hình giáo viên, thay vì bỏ qua chúng như các phương pháp truyền thống.
- Nghiên cứu / bài báo
Đánh giá OpenWiki với WikiBench: Liệu tài liệu Wiki có giúp AI lập trình thông minh hơn?
LangChain giới thiệu WikiBench để kiểm chứng hiệu quả của tài liệu Wiki đối với các tác nhân AI lập trình. Kết quả cho thấy việc kết hợp Wiki với mã nguồn giúp cải thiện hiệu suất đáng kể và tối ưu chi phí so với chỉ sử dụng mã nguồn đơn thuần.
- Hướng dẫn / quan điểm
Hướng dẫn huấn luyện và tinh chỉnh mô hình nhúng đa vector với Sentence Transformers
Sentence Transformers v6.0 ra mắt MultiVectorEncoder, hỗ trợ truy xuất hậu tương tác kiểu ColBERT cùng quy trình huấn luyện toàn diện giúp tối ưu hiệu suất RAG.
- Hướng dẫn / quan điểm
Trải nghiệm thực tế Doubao Work: 8 mẹo tối ưu hóa hiệu suất làm việc trên Lark
Doubao Work là giải pháp Agent doanh nghiệp dễ tiếp cận nhất hiện nay khi tích hợp sâu vào hệ sinh thái Lark. Bài viết chia sẻ các mẹo sử dụng như điều khiển từ xa, tự động hóa tác vụ và khả năng đồng bộ trực tiếp, giúp tối ưu hóa quy trình làm việc chuyên nghiệp.
- Hướng dẫn / quan điểm
Warp: Cách xây dựng AI tự tối ưu hóa trên nền tảng Claude
Warp áp dụng mô hình Agent Skills để biến phản hồi từ con người thành vòng lặp tự cải tiến cho AI, giúp tối ưu hóa quy trình code trên quy mô lớn. Phương pháp này nhấn mạnh việc thiết lập nguyên tắc thay vì quy tắc cứng nhắc để tăng tính linh hoạt.
- Hướng dẫn / quan điểm
Hướng dẫn sử dụng GitHub Copilot: Tự động hóa phân loại Dependabot Pull Request
GitHub Copilot giờ đây có thể tự động xử lý bước đầu các yêu cầu Dependabot, từ phân loại rủi ro, kiểm tra CI đến tổng hợp báo cáo, giúp lập trình viên tiết kiệm thời gian quản lý bảo mật.
- Hướng dẫn / quan điểm
Bill Gates kêu gọi xây dựng chiến lược AI toàn diện, Gary Marcus đồng tình
Bill Gates cảnh báo về các rủi ro từ AI như khủng bố sinh học và tin giả, đồng thời kêu gọi sự tham gia của xã hội dân sự trong việc thiết lập khung quản trị AI toàn cầu. Gary Marcus đánh giá cao quan điểm này, cho rằng nó tương đồng với những luận điểm trong cuốn sách mới nhất của ông.