The Decoder: AI News
Điểm AI 55/100

Sản phẩm

Chip AI tự phát triển Jalapeño của OpenAI được cho là vượt mặt Nvidia Blackwell và Rubin

(giờ Việt Nam)

Tóm tắt AI

Tại hội nghị Hot Chips, OpenAI đã công bố kết quả thử nghiệm chip Jalapeño, cho thấy hiệu suất vượt trội so với các dòng chip Blackwell và Rubin của Nvidia về tốc độ xử lý token và hiệu quả năng lượng.

Chính văn · Bản dịch AI

OpenAI's first custom chip "Jalapeño" reportedly beats Nvidia's Blackwell and Rubin in inference benchmarks

OpenAI đã trình diễn các kết quả benchmark đầu tiên cho chip suy luận (inference chip) tự phát triển tại hội nghị Hot Chips. Theo báo cáo, "Jalapeño" vượt trội hơn cả Blackwell và Rubin của Nvidia về thông lượng trên mỗi watt và độ trễ token.

Con chip này chỉ xử lý suy luận, nghĩa là nó chạy các mô hình AI chứ không dùng để huấn luyện. Jalapeño cũng không được tinh chỉnh riêng cho các mô hình của OpenAI mà là một bộ tăng tốc suy luận LLM đa năng.

OpenAI tuyên bố Jalapeño mang lại hiệu suất công việc AI trên mỗi watt cao gấp 1,5 đến 1,9 lần ở mức thông lượng đỉnh trên cả ba mô hình được thử nghiệm, với độ trễ từ đầu đến cuối thấp hơn từ 1,7 đến 3,6 lần so với các hệ thống thương mại tốt nhất hiện có. Đối với các tác vụ tương tác, công ty cho biết hiệu suất cao hơn từ 2,1 đến 4,1 lần.

Các kết quả này đến từ các bài kiểm tra sử dụng benchmark InferenceX công khai của SemiAnalysis. OpenAI là đơn vị cung cấp các con số, còn SemiAnalysis đã xác minh một số lượt chạy trực tiếp tại phòng thí nghiệm. Các mô hình được thử nghiệm bao gồm GPT-OSS 120B, Deepseek R1 670B và Kimi K2.5 1T. Trên GPT-OSS, Jalapeño đạt khoảng 1.400 token mỗi giây cho mỗi người dùng. Trên Deepseek R1, con số này vượt mức 700 token mỗi giây cho một yêu cầu đồng thời.

Jalapeño erzielt bei gleicher Decoding-Geschwindigkeit je nach Modell das 54- bis 104-Fache des Token-Durchsatzes pro Kilowatt im Vergleich zum besten verfügbaren Beschleuniger. | Bild: OpenAI

Jalapeño đạt được những con số này mà không cần sử dụng các kỹ thuật như dự đoán đa token (multi-token prediction) hay giải mã suy đoán (speculative decoding), trong khi một số hệ thống đối chứng lại dựa vào các tối ưu hóa đó, vì vậy vẫn còn dư địa để cải thiện.

Trong so sánh về hiệu suất trên mỗi watt, SemiAnalysis viết: "Jalapeño đánh bại mọi con chip khác". CEO Dylan Patel của SemiAnalysis nói thêm: "Thông thường các con chip thế hệ đầu tiên không có tính cạnh tranh, nhưng OpenAI đang đánh bại Nvidia Blackwell và thậm chí cả Rubin".

SemiAnalysis chỉ ra rằng sự so sánh công bằng hơn không phải là Blackwell mà là nền tảng Vera Rubin mới hơn của Nvidia, vì cả hai đều sử dụng bộ nhớ HBM4. Ngay cả ở đây, Jalapeño vẫn tạo ra nhiều token đầu ra trên mỗi megawatt hơn Vera Rubin, mặc dù bộ tăng tốc của Nvidia sử dụng kỹ thuật tối ưu hóa dự đoán đa token mà Jalapeño chưa áp dụng. Về tổng chi phí sở hữu trên mỗi token, cả hai đạt kết quả gần như ngang bằng.

Tuy nhiên, vẫn có những lưu ý. Nvidia và AMD đã công bố kết quả với các mô hình lớn hơn như Deepseek V4 Pro và Kimi K3 mà Jalapeño chưa được thử nghiệm. Và trong khi các hệ thống Rubin đã được chuyển đến tay khách hàng, Jalapeño được cho là vẫn chưa vượt qua giai đoạn mẫu kỹ thuật.

OpenAI đã chế tạo con chip này trong chín tháng, một phần nhờ sử dụng chính các mô hình của mình.

OpenAI phát triển Jalapeño cùng với Broadcom. Công việc thiết kế bắt đầu vào giữa năm 2024 và thiết kế cuối cùng được đưa vào sản xuất vào tháng 11 năm 2025. Chu kỳ đầy đủ mất khoảng 16 tháng, nhưng OpenAI cho biết chỉ mất chín tháng từ khi thiết kế chip đầu tiên đến khi bản thiết kế hoàn thiện được gửi đến nhà máy. Theo OpenAI, công ty đã sử dụng các mô hình AI của chính mình trong quá trình phát triển. Các thế hệ mô hình cũ hơn hỗ trợ thiết kế chip, trong khi các mô hình mới hơn giúp tăng tốc lập trình và tối ưu hóa.

SemiAnalysis coi đây là dấu hiệu cho thấy "hào lũy CUDA" (CUDA moat) vốn được nhắc đến nhiều của Nvidia có thể không còn vững chắc nữa. "Hào lũy CUDA có khả năng đã chết khi xét đến tốc độ OpenAI có thể triển khai các mô hình mới trên silicon của họ", công ty này viết.

CFO Sarah Friar của OpenAI cho biết con chip này phù hợp với chiến lược tính toán rộng lớn hơn, nơi các trung tâm dữ liệu, chip, mô hình, nền tảng nhà phát triển, sản phẩm và thiết bị đều hoạt động như một hệ thống tích hợp. Bà khẳng định Jalapeño bổ sung cho các quan hệ đối tác hiện có của OpenAI với Nvidia, AMD, AWS, Cerebras, CoreWeave và những đơn vị khác thay vì thay thế họ.

OpenAI có mối quan hệ sâu sắc với một số công ty này. Nvidia, AMD và AWS đều là các nhà đầu tư hoặc đối tác tính toán, trong đó Nvidia là một trong những đối tác lớn nhất. Mỗi công ty trong số đó cũng đang tự xây dựng chip AI riêng, điều này khiến mối quan hệ vừa mang tính hợp tác vừa mang tính cạnh tranh. Dù vậy, tất cả các công ty này đều liên tục khẳng định thế giới không bao giờ có đủ năng lực tính toán, một tuyên bố hỗ trợ thuận tiện cho chính mô hình kinh doanh của họ.

Tin tức AI không cường điệu – Được tuyển chọn bởi con người.

Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.

Đăng ký ngay.

OpenAINvidiaChip AIPhần cứngJalapeño

Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Chip AI tự phát triển Jalapeño của OpenAI được cho là vượt mặt Nvidia Blackwell và Rubin | AIHOT.vn