20/08

Thứ Năm · 1 tin
LMSYS: Blog (nhóm Chatbot Arena)
Nghiên cứuĐiểm AI 73/100

Tinh chọnTối ưu hóa DeepSeek-V4-Pro trên GPU H20: Đột phá hiệu năng tiệm cận chip B300

Nhóm LMSYS đã tối ưu hóa mô hình MoE 1.6 nghìn tỷ tham số DeepSeek-V4-Pro trên GPU H20, đạt tốc độ 271 tokens/s, thu hẹp đáng kể khoảng cách hiệu năng so với chip B300.


Vì sao đáng đọc: Bài viết cung cấp giải pháp kỹ thuật thực tế cho bài toán tối ưu hóa phần cứng, có giá trị cao cho cộng đồng kỹ sư AI đang sử dụng hạ tầng GPU bị hạn chế.
Tổng 1 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (10 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “H20” | AIHOT.vn