23/08

Chủ Nhật · 7 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 55/100

Cùng sự kiệnGiá máy chủ AI của Nvidia tăng 17% do chi phí bộ nhớ leo thang

JUST IN: Nvidia has informed some of its major customers that servers powered by its AI chips are ge…

DịchNvidia thông báo tăng giá máy chủ AI khoảng 17% do giá bộ nhớ HBM4 và LPDDR5X tăng mạnh. Động thái này dự kiến sẽ đẩy chi phí xây dựng trung tâm dữ liệu 1GW lên thêm ít nhất 5 tỷ USD và làm tăng giá thuê GPU trên toàn cầu.

Cùng sự kiện, bài đại diện «Thiếu hụt bộ nhớ khiến giá máy chủ AI của Nvidia tăng vọt 15%»
SemiAnalysis@SemiAnalysis_
Hướng dẫnĐiểm AI 48/100

Tok/s/MW: Chỉ số mới đánh giá hiệu suất năng lượng của LLM

A useful metric for evaluating LLM inference is tok/s/MW: how many tokens a system generates per sec…

DịchChỉ số tok/s/MW đo lường số lượng token tạo ra trên mỗi megawatt điện năng tiêu thụ, giúp đánh giá hiệu quả vận hành của các hệ thống LLM như DeepSeek V4 trên phần cứng B300.

22/08

Thứ Bảy · 7 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 45/100

Waymo lần đầu hé lộ hệ thống tính toán tự lái: Chip ASIC 5nm tự phát triển và kiến trúc dự phòng

Waymo công bố hệ thống tính toán AI vật lý với chip ASIC 5nm tự thiết kế, đạt hiệu suất hơn 1.000 TOPS. Hệ thống sử dụng kiến trúc dự phòng kép để đảm bảo quyết định thời gian thực trong vài mili giây.

21/08

Thứ Sáu · 5 tin
QbitAI
NgànhĐiểm AI 85/100

Trung Quốc ra mắt 'điện toán đúc sẵn': Lắp đặt tại nhà máy 90%, vận hành trong 24 giờ, tăng 70% hiệu suất

Công nghệ 'điện toán đúc sẵn' mới của Trung Quốc cho phép triển khai hạ tầng trung tâm dữ liệu cực nhanh với tỷ lệ lắp ráp tại nhà máy hơn 90%, giúp rút ngắn thời gian bàn giao xuống chỉ còn 24 giờ.

20/08

Thứ Năm · 8 tin
Kim@kimmonismus
Sản phẩmĐiểm AI 41/100

Cerebras CS-4 ra mắt: Đột phá hiệu năng suy luận AI gấp đôi nhờ tối ưu phần cứng

This is seriously impressive: Cerebras just unveiled CS-4, and nearly doubled its AI inference perfo…

DịchCerebras CS-4 tối ưu hóa hệ thống tản nhiệt và nguồn điện để tăng gấp đôi tốc độ xung nhịp, đạt hiệu năng suy luận vượt trội gấp 30 lần so với hệ thống GPU truyền thống trên mô hình GPT-OSS-120B.

SemiAnalysis@SemiAnalysis_
NgànhĐiểm AI 19/100

SemiAnalysis treo thưởng 200 USD để tích hợp Etched vào Tinygrad

In the spirit of @__tinygrad__, we will be offering a $200 bounty for anyone who implements @Etched …

DịchSemiAnalysis vừa công bố khoản tiền thưởng 200 USD cho bất kỳ ai có thể triển khai hỗ trợ Etched trong Tinygrad bằng driver không gian người dùng 100% Python, với yêu cầu mã nguồn dưới 10.000 dòng.

19/08

Thứ Tư · 12 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 43/100

PTXBench: Đánh giá và tối ưu hóa nhân GPU cho LLM bằng mã PTX đặc thù kiến trúc

PTXBench là bộ benchmark mới đánh giá khả năng tối ưu hóa nhân GPU của LLM thông qua mã PTX trên H100 và B200. Kết quả cho thấy các mô hình hiện nay vẫn gặp khó khăn trong việc đạt hiệu suất tương đương với các thư viện chuyên dụng, đặc biệt là trong các tác vụ Attention phức tạp.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Sản phẩmĐiểm AI 64/100

Cùng sự kiệnNgôn ngữ lập trình Mojo chính thức mã nguồn mở, hỗ trợ đa dạng phần cứng từ Trainium đến TPU

Tại sự kiện ModCon 2026, Modular công bố Mojo 1.0 mã nguồn mở theo giấy phép Apache 2.0, đồng thời mở rộng hỗ trợ phần cứng và hợp tác với Microsoft để phát triển phiên bản Windows.

Cùng sự kiện, tinh chọn hiển thị «Ngôn ngữ lập trình Mojo chính thức mã nguồn mở, công khai toàn bộ trình biên dịch»
SemiAnalysis@SemiAnalysis_
Sản phẩmĐiểm AI 35/100

Cerebras ra mắt CS-4: Hiệu năng tăng gấp đôi, tốc độ bứt phá

Cerebras's Next Generation CS-4: Fast Just Got Faster Double the Performance, Double the Power, Doub…

DịchCerebras chính thức giới thiệu thế hệ CS-4 với bước nhảy vọt về hiệu năng, mang lại sức mạnh tính toán vượt trội gấp đôi so với phiên bản tiền nhiệm, tối ưu hóa cho các tác vụ AI quy mô lớn.

18/08

Thứ Ba · 3 tin
IT Home
Sản phẩmĐiểm AI 46/100

Ra mắt nguyên mẫu máy chủ tích hợp sinh học đầu tiên trên thế giới: Sự kết hợp giữa tế bào thần kinh và silicon

Đại học Quốc gia Singapore cùng DayOne và Cortical Labs vừa giới thiệu hệ thống máy chủ sử dụng tế bào thần kinh người để xử lý thông tin. Với mức tiêu thụ chỉ 30W mỗi đơn vị, công nghệ này mở ra kỷ nguyên mới cho điện toán sinh học tiết kiệm năng lượng.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (44 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Phần cứng AI” — Trang 11 | AIHOT.vn