Google chuẩn bị phóng vệ tinh nguyên mẫu trang bị chip TPU nhằm kiểm tra khả năng vận hành của hạ tầng AI trong môi trường vũ trụ khắc nghiệt, hướng tới mục tiêu thiết lập mạng lưới tính toán AI ngoài không gian vào năm 2027.
Diễn biến sự kiện · 9 bài →Thêm 7 nguồn khác đưa tinX: Viggle AI (@ViggleAI)X: Rohan Paul (@rohanpaul_ai)X: Sundar Pichai (@sundarpichai)The Decoder: AI NewsArs Technica: AIThe Verge: AIIT Home
Epic moment indeed. Google's "Project Suncatcher". we're about to watch AI compute leave the plane…
DịchGoogle hợp tác cùng Planet phát triển Project Suncatcher, dự kiến phóng 2 vệ tinh tích hợp TPU vào năm 2027. Hệ thống sử dụng liên kết laser đạt tốc độ 800Gbps để vận hành các tác vụ AI trực tiếp trên quỹ đạo.
Sundar Pichai xác nhận Project Suncatcher sẽ hợp tác cùng SpaceX trong nhiệm vụ Transporter-18 để thử nghiệm khả năng vận hành của chip TPU trong môi trường khắc nghiệt ngoài không gian.
Google sẽ phóng vệ tinh trang bị chip TPU thông qua tên lửa SpaceX Falcon 9 nhằm kiểm tra khả năng vận hành của AI trong môi trường khắc nghiệt, đánh dấu bước khởi đầu của dự án Project Suncatcher.
DịchGiả thuyết cho rằng cảm giác mô hình bị 'giảm sức mạnh' thực chất đến từ việc sử dụng các loại phần cứng khác nhau (GPU, TPU, Inferentia) để xử lý tải trọng cao, dẫn đến chất lượng đầu ra không đồng nhất.
Tại SEMICON Taiwan 2026, Google công bố kiến trúc TPU mới hỗ trợ cụm 1 triệu chip. CTO Amin Vahdat cảnh báo rằng khi nhu cầu tính toán từ các tác nhân AI (AI agents) bùng nổ, nguồn cung điện năng đang trở thành rào cản hạ tầng quan trọng hơn cả tình trạng thiếu chip.
Google giới thiệu autofinetune, sử dụng AI Agent kết hợp Gemini Flash 3.7 để tự động hóa quy trình SFT và GRPO cho LLM trên hạ tầng TPU, giúp tối ưu hóa việc huấn luyện mô hình.
TPU Inference Externalization Full Steam Ahead - InferenceX, Up to 50% Better Performance per Dolla…
DịchBáo cáo từ SemiAnalysis cho thấy công nghệ InferenceX giúp tối ưu hóa chi phí TPU lên tới 50%, đồng thời đẩy nhanh quá trình phổ cập hạ tầng TPU, trực tiếp thách thức rào cản kỹ thuật của hệ sinh thái CUDA.
MaxKernel là hệ thống đa tác nhân sử dụng LLM kết hợp phản hồi từ trình biên dịch để tự động thiết kế, kiểm thử và tối ưu hóa các nhân xử lý hiệu năng cao cho chip TPU, giúp giảm bớt gánh nặng chuyên môn phần cứng.
François Chollet vừa chia sẻ bảng so sánh tốc độ xử lý của các mô hình AI hàng đầu, trong đó ông đặc biệt nhấn mạnh đến vai trò và hiệu suất của chip TPU.
Google Cloud tích hợp hỗ trợ TPU vào vLLM, tối ưu hóa cho dòng mô hình Qwen3 để xử lý suy luận Embedding đa phương thức với ngữ cảnh dài (4K+ token văn bản, 15K+ token đa phương thức).
Bài viết phân tích sự bùng nổ của kiến trúc chuyên dụng (DSA) trong kỷ nguyên AI, nơi các dòng chip như GPU, TPU và LPU đang định hình lại cuộc đua hạ tầng tính toán toàn cầu.
Anthropic vừa chiêu mộ Amir Salek, người đứng sau 7 thế hệ TPU của Google, nhằm xây dựng đội ngũ thiết kế chip riêng, giảm sự phụ thuộc vào các nhà cung cấp bên ngoài và tối ưu hóa chi phí vận hành cho các mô hình Claude.
Vì sao đáng đọc: Tin tức quan trọng về chiến lược hạ tầng của một trong những công ty AI hàng đầu thế giới, cho thấy xu hướng các hãng AI lớn đang dần chuyển mình sang tự chủ phần cứng.
TPU🚨 is working with the popular OSS inference optimization library Mooncake on integrating TPU wit…
DịchGoogle TPU hợp tác với thư viện Mooncake để tối ưu hóa hiệu suất suy luận thông qua cơ chế chia sẻ bộ nhớ KVCache trên mạng lưới mở rộng, giúp cải thiện đáng kể hiệu quả chi phí (TCO) cho các hệ thống AI quy mô lớn.
Theo báo cáo từ SemiAnalysis, Google đang hợp tác với AMD để phát triển TPU thế hệ thứ 10. Đây có thể là dự án chip AI tùy chỉnh đầu tiên của AMD, tận dụng thế mạnh về đóng gói tiên tiến và IP CPU của hãng để cạnh tranh trong thị trường chip AI.
Every co-author of "Attention Is All You Need" has now left Google. Jeff Dean and Sanjay Ghemawat ar…
DịchToàn bộ nhóm tác giả bài báo "Attention Is All You Need" đã rời Google. Sự kiện này cho thấy Google đang chuyển dịch trọng tâm từ phát triển mô hình AI tiên phong sang khai thác hạ tầng TPU và dịch vụ đám mây để tối ưu hóa lợi nhuận.
Tại sự kiện Cloud Next '26, Google ra mắt TPU thế hệ 8 với hai phiên bản chuyên biệt: TPU 8t tối ưu cho huấn luyện và TPU 8i tập trung vào tốc độ suy luận, cùng chia sẻ kiến trúc phần mềm và hạ tầng làm mát.
HeyGen đã chuyển đổi mô hình tạo video Avatar IV với hơn 18 tỷ tham số sang nền tảng Google Cloud Trillium TPU, sử dụng kỹ thuật song song hóa tiên tiến để tăng tốc hiệu suất.
By 2027, there will be some TPUs in space. - Sundar Pichai "Sun emits 100 trillion times more pow…
DịchSundar Pichai tiết lộ kế hoạch triển khai chip TPU trong không gian vào năm 2027, tận dụng nguồn năng lượng mặt trời dồi dào ngoài quỹ đạo để tối ưu hóa hiệu suất tính toán.
Google's 7 and 8 years old TPUs are still seeing 100% utilization. Says Amin Vahdat, GP and GM of …
DịchPhó chủ tịch Google Cloud cho biết TPU từ 8 năm trước vẫn đạt hiệu suất 100%, minh chứng cho nghịch lý Jevons khi nhu cầu AI tăng nhanh hơn cả hiệu quả phần cứng. Điều này lý giải vì sao các dòng GPU cũ như A100 vẫn được ký hợp đồng thuê dài hạn đến năm 2029.