Nghiên cứu giới thiệu phương pháp 'ready-cohort' nhằm xác định ranh giới thực thi trên GPU cho các tác nhân LLM, giúp giữ quyết định tại thiết bị và tăng tốc độ xử lý lên tới 2,39 lần so với cách tiếp cận truyền thống.
Cambricon đã tích hợp thành công các mô hình GLM, DeepSeek, Qwen, Kimi và MiniMax vào chip của hãng, đồng thời báo cáo doanh thu tăng trưởng ấn tượng 108%. Công ty hiện đang tập trung phát triển kiến trúc chip thế hệ thứ 6 nhằm tối ưu hóa hiệu suất cho các tác vụ huấn luyện AI.
Tencent reported H1 2026 revenue of $56.1 billion, up 10%, and gross profit of $32.1 billion, up 12%…
DịchNửa đầu năm 2026, Tencent đạt doanh thu 56,1 tỷ USD nhưng dòng tiền tự do chuyển âm do chi phí đầu tư hạ tầng AI. Công ty đang tập trung xây dựng các dịch vụ AI gốc và tối ưu hóa chi phí thông qua việc cho thuê hạ tầng điện toán đám mây.
Google's 7 and 8 years old TPUs are still seeing 100% utilization. Says Amin Vahdat, GP and GM of …
DịchPhó chủ tịch Google Cloud cho biết TPU từ 8 năm trước vẫn đạt hiệu suất 100%, minh chứng cho nghịch lý Jevons khi nhu cầu AI tăng nhanh hơn cả hiệu quả phần cứng. Điều này lý giải vì sao các dòng GPU cũ như A100 vẫn được ký hợp đồng thuê dài hạn đến năm 2029.
Some really interesting numbers on GPU depreciation cycle. A 6-year-old NVIDIA GPU generation stil…
DịchCoreWeave kéo dài thời hạn khấu hao GPU A100 lên 6 năm và ký hợp đồng dịch vụ đến 2029, cho thấy sức sống bền bỉ của các dòng chip cũ nhờ hệ sinh thái CUDA và nhu cầu suy luận AI.
The @latentspacepod team and I will be speaking at Mongodb's.local buildfest today 10a-4pmish, come…
Dịchswyx cùng các chuyên gia từ Voyage AI và MongoDB sẽ chia sẻ về hạ tầng AI Agent, kỹ thuật embedding/re-ranking, AI đeo tay và MCP tại sự kiện MongoDB.local.
Cisco vừa báo cáo kết quả kinh doanh ấn tượng trong năm tài chính 2026 với doanh thu đạt 63,3 tỷ USD, tăng 12%. Kết quả này vượt kỳ vọng của thị trường nhờ sự bứt phá mạnh mẽ từ mảng hạ tầng AI và tăng trưởng lợi nhuận hai con số.
The mighty A100 fleet are mission-capable from 2020 through 2029. NVIDIA computing is more than chip…
DịchJensen Huang nhấn mạnh sức mạnh của NVIDIA không chỉ nằm ở chip mà còn ở hệ sinh thái CUDA, giúp các kiến trúc từ Ampere đến Blackwell duy trì tính bền bỉ và khả năng sử dụng lâu dài cho các trung tâm dữ liệu.
CoreWeave vừa ký hợp đồng cho thuê chip Nvidia A100 đến năm 2029, chứng minh rằng GPU cũ vẫn có giá trị kinh tế cao và vòng đời thực tế dài hơn nhiều so với dự đoán của thị trường.
PoV of NVIDIA acquiring Groq, and then the leftover of Groq is now buying NVIDIA B300/GB300/Rubin GP…
DịchSemiAnalysis dự đoán NVIDIA có khả năng mua lại Groq, trong khi Groq đang đẩy mạnh việc mua sắm GPU Blackwell để cho các doanh nghiệp thuê lại, thay vì chỉ tập trung vào chip LPU như trước.
LangChain ra mắt Managed Deep Agents, cung cấp nền tảng quản lý toàn diện từ vận hành, lưu trữ đến đánh giá, giúp nhà phát triển triển khai AI Agent vào thực tế mà không cần tự xây dựng hạ tầng phức tạp.
Với mức tiêu thụ khổng lồ từ các cụm siêu máy tính, Trung Quốc đang đẩy mạnh chuyển đổi sang năng lượng xanh, trong đó các trung tâm dữ liệu mới tại nhiều khu vực đã đạt tỷ lệ sử dụng điện sạch trên 80%.
SGLang và Miles đã cập nhật hỗ trợ Day-0 cho Qwen3.8-2.4T-A95B, mô hình mã nguồn mở lớn nhất của Qwen với 2,4 nghìn tỷ tham số và kiến trúc Mixture-of-Attention.
Kioxia và SanDisk vừa giới thiệu chip nhớ QLC 3D thế hệ thứ 9 với dung lượng 2Tb, sử dụng kiến trúc CBA giúp tăng 33% tốc độ giao tiếp lên 4.8Gb/s, đáp ứng nhu cầu lưu trữ khổng lồ cho hạ tầng AI.
Tencent báo cáo doanh thu quý 2 tăng 11% và đẩy mạnh đầu tư hạ tầng AI lên 52,8 tỷ NDT. Hãng dự kiến nguồn cung GPU sẽ ổn định từ cuối năm nay, giúp tối ưu hóa các mô hình Hy, WorkBuddy và dịch vụ đám mây.
Sự kiện hợp tác giữa Yunqi và WRC sẽ tập trung thảo luận về mô hình thế giới (World Models) và hạ tầng thông minh, quy tụ nhiều chuyên gia đầu ngành trong lĩnh vực AI và robot.
Tencent báo cáo dòng tiền tự do âm 13,8 tỷ NDT trong quý 2/2026 do chi mạnh tay cho hạ tầng AI. Công ty khẳng định nếu không tính các khoản trả trước cho việc mua sắm năng lực tính toán, dòng tiền tự do thực tế đạt 37,6 tỷ NDT.
Nhà cung cấp hạ tầng AI doanh nghiệp MatrixOrigin vừa hoàn tất vòng gọi vốn Series A với hơn 10 triệu USD, thu hút sự tham gia của các quỹ đầu tư từ Hande Information, Yakang Software và quỹ Artesian của Úc.
DeepSeek đang ráo riết tuyển dụng kỹ sư điện, HVAC và xây dựng để vận hành hạ tầng AI, cho thấy xu hướng các tập đoàn công nghệ Trung Quốc đang chuyển dịch sang sở hữu trực tiếp tài sản vật lý và năng lượng.
Hội nghị Điện toán Trung Quốc 2026 sẽ diễn ra từ ngày 11-13/9 tại Lang Phường, Hà Bắc với chủ đề kết nối mạng lưới điện toán. Sự kiện lần đầu tổ chức buổi công bố các sản phẩm phần cứng, phần mềm AI nội địa mới nhất, cùng triển lãm mở cửa miễn phí cho công chúng.
Alibaba Cloud vừa triển khai cụm siêu máy tính Lingjun Zhenwu M890, cho phép doanh nghiệp thuê hạ tầng tính toán hiệu năng cao để vận hành các mô hình AI lên tới 10 nghìn tỷ tham số mà không cần tự xây trung tâm dữ liệu.
DeepSeek đang mở rộng quy mô hạ tầng bằng cách tuyển dụng đội ngũ chuyên trách về quy hoạch, xây dựng và vận hành trung tâm dữ liệu tại nhiều thành phố lớn, cho thấy tham vọng tự chủ hạ tầng bên cạnh việc phát triển mô hình AI.
Nền tảng MaaS của Zhipu ghi nhận sự tăng trưởng mạnh mẽ với gần 7 triệu người dùng API. Để đáp ứng nhu cầu suy luận ngày càng cao, công ty đã kích hoạt thêm hơn 50.000 chip AI sản xuất trong nước.
Nvidia cùng các ngân hàng đầu tư lập quỹ 500 tỷ USD cho các công ty AI vay mua GPU, nhằm chia sẻ rủi ro và thúc đẩy nhu cầu hạ tầng tính toán trong cuộc đua AGI.
Alibaba Cloud chính thức ra mắt siêu node M890, cho phép doanh nghiệp vận hành các mô hình MoE quy mô 10 nghìn tỷ tham số với hiệu suất huấn luyện tăng gấp 3 lần so với thế hệ trước.
Cuộc đua AI không còn chỉ xoay quanh chip và mô hình, mà đang chuyển trọng tâm sang hạ tầng trung tâm dữ liệu. Alibaba Cloud vừa gây chú ý khi tối ưu hóa quy trình, rút ngắn thời gian bàn giao hạ tầng xuống chỉ còn 100 ngày để đáp ứng cơn khát năng lực tính toán.
IBM hợp tác cùng Together AI trong thỏa thuận trị giá 240 triệu USD để triển khai cụm NVIDIA HGX B300 trên IBM Cloud, nhằm tối ưu hóa dịch vụ suy luận mô hình mã nguồn mở từ quý 1/2027.
NVIDIA hợp tác cùng Apollo, BlackRock và các tập đoàn tài chính hàng đầu để huy động 500 tỷ USD, biến các 'nhà máy AI' thành một loại hình tài sản đầu tư mới.
DịchDự án OpenCode Go vừa ghi nhận kỷ lục mới khi xử lý thành công 11 nghìn tỷ token chỉ trong một ngày, đánh dấu bước tiến quan trọng trong năng lực xử lý dữ liệu quy mô lớn.
Oracle đang chuẩn bị đợt sa thải mới nhằm cắt giảm chi phí vận hành, sau khi đổ hàng chục tỷ USD vào hạ tầng AI. Dù mảng điện toán đám mây tăng trưởng mạnh, áp lực nợ nần và giá cổ phiếu sụt giảm buộc công ty phải tinh giản bộ máy trước thềm quý tài chính mới.
CoreWeave ghi nhận doanh thu tăng vọt nhờ nhu cầu hạ tầng AI, dù vẫn chịu lỗ do mở rộng quy mô. Công ty hiện sở hữu lượng đơn hàng tồn đọng khổng lồ 104 tỷ USD và tiên phong triển khai hệ thống NVIDIA Vera Rubin NVL72.
☁️Mistral is bringing together the inference infrastructure, open models, and long-term commitments …
DịchMistral AI đang xây dựng hệ sinh thái toàn diện kết hợp hạ tầng suy luận và các mô hình mở, khẳng định cam kết giúp châu Âu làm chủ tương lai công nghệ AI.
Nvidia vừa giới thiệu hệ thống Nemotron 3.5 Lightning cùng công cụ NeMo Switchyard, giúp tối ưu hóa hiệu suất suy luận và tăng tính linh hoạt khi triển khai các mô hình ngôn ngữ lớn (LLM).
Starmind 💫 It's possible to scale compute power much more easily in space than on land once you ha…
DịchVới sự hỗ trợ của tên lửa tái sử dụng và vệ tinh sản xuất hàng loạt, việc mở rộng hạ tầng tính toán trong không gian đang trở nên khả thi và hiệu quả hơn so với trên mặt đất.
Most powerful computing clusters in the world SpaceX in Memphis/Southaven has 1.4GW of nameplate dr…
DịchSiêu máy tính của SpaceX tại Memphis hiện đạt công suất 1.4GW và đang hướng tới cột mốc 10GW vào cuối năm sau để phục vụ nhu cầu tính toán khổng lồ.
Lumentum ghi nhận doanh thu tăng trưởng ấn tượng 83,2% nhờ nhu cầu kết nối quang học cho AI, tuy nhiên lợi nhuận chuyển sang lỗ 6,9 tỷ USD do chi phí xử lý nợ trái phiếu chuyển đổi.
New Google paper shows LLM infrastructure optimization does not have to be a giant brute-force searc…
DịchGoogle ra mắt PROMPTS, sử dụng các AI Agent để xác định nút thắt cổ chai (tính toán, bộ nhớ, truyền tải) và đề xuất cấu hình tối ưu cho TPU, giúp thay thế phương pháp tìm kiếm vét cạn truyền thống.
Alibaba Cloud says it can now build large AI data centres in 100 days while cutting construction cos…
DịchAlibaba Cloud áp dụng thiết kế CUBE 5.0 giúp rút ngắn thời gian xây dựng trung tâm dữ liệu AI xuống còn 100 ngày và giảm 10% chi phí, nhờ chuyển đổi quy trình lắp đặt hạ tầng sang sản xuất mô-đun tại nhà máy.