JENSEN IS A LIAR, HE IS UNDERPROMISING & OVERDELIVERING 🚀🚀🚀 At GTC 2026, Jensen only claimed …
DịchCác thử nghiệm thực tế từ SemiAnalysis cho thấy Rubin NVL72 đạt hiệu suất trên mỗi watt gấp 7 lần so với GB300, vượt xa con số 3 lần mà Jensen Huang từng công bố.
Tại hội nghị AI Infra Summit, NVIDIA giới thiệu nền tảng DSX MaxLPS giúp tăng 40% công suất GPU và 35% lưu lượng token trên cùng một mức tiêu thụ điện năng, tối ưu hóa hiệu quả cho các trung tâm dữ liệu AI.
Tại AI Infra Summit, NVIDIA công bố công nghệ DSX MaxLPS giúp cụm máy chủ HGX B200 tăng 24% lưu lượng token và cải thiện 23% hiệu suất trên mỗi watt điện, cho phép chạy nhiều node hơn với cùng mức ngân sách năng lượng.
BorisMPower ước tính AI hiện đạt hiệu suất IQ từ 7-40 trên mỗi Watt, vượt xa mức 5 của con người. Dựa trên phần cứng và mô hình mới nhất, AI không chỉ thông minh hơn mà còn hoàn thành nhiệm vụ nhanh gấp 7 lần với mức tiêu thụ năng lượng tối ưu hơn.
OpenAI's new Jalapeño chip announced at Hot Chips beats Vera Rubin's July results on Output Throughp…
DịchTại hội nghị Hot Chips, OpenAI đã công bố chip Jalapeño mới với khả năng tối ưu hóa năng lượng vượt trội, đạt hiệu suất trên mỗi megawatt cao hơn so với kết quả của Vera Rubin hồi tháng 7.
Thử nghiệm với mô hình DeepSeek-V4-PRO cho thấy hệ thống Vera Rubin NVL72 đạt hiệu suất năng lượng gấp 30 lần so với GB300, đồng thời giảm chi phí vận hành trên mỗi triệu token xuống chỉ còn 1/35.
A useful metric for evaluating LLM inference is tok/s/MW: how many tokens a system generates per sec…
DịchChỉ số tok/s/MW đo lường số lượng token tạo ra trên mỗi megawatt điện năng tiêu thụ, giúp đánh giá hiệu quả vận hành của các hệ thống LLM như DeepSeek V4 trên phần cứng B300.