# OpenAI khẳng định chip Jalapeño vượt mặt Nvidia về tốc độ suy luận AI

- Nguồn: The Verge: AI
- Thời gian phát hành: 2026-08-25 21:00 (giờ Việt Nam)
- Điểm AI: 55/100
- Link AIHOT.vn: https://aihot.vn/items/ef3178a8461a8b5f
- Nguồn dữ liệu AI HOT: https://aihot.news/items/cmt8reski3m35ro73xdd3i0kc
- Link gốc: https://www.theverge.com/ai-artificial-intelligence/984290/openai-jalapeno-ai-chip-benchmarks

## Tóm tắt AI

OpenAI công bố chip Jalapeño hợp tác cùng Broadcom, đạt hiệu suất suy luận vượt trội so với các dòng siêu chip GB200/GB300 của Nvidia trong bài kiểm tra InferenceX.

## Thân bài

![OpenAI says its Jalapeño chip can power faster AI responses than the competition](https://platform.theverge.com/wp-content/uploads/sites/2/2026/08/Jalapeno-chip-final.jpeg?quality=90&strip=all&crop=0%2C15.095986038394%2C100%2C69.808027923211&w=1200)

Emma Roth

là một cây bút tin tức chuyên đưa tin về cuộc chiến streaming, công nghệ tiêu dùng, tiền điện tử, mạng xã hội và nhiều lĩnh vực khác. Trước đây, cô từng là biên tập viên và cây bút tại MUO.

OpenAI cho biết con chip AI mới của họ, Jalapeño, có khả năng hoàn thành các tác vụ hiệu quả hơn và phản hồi nhanh hơn so với các hệ thống AI khác, theo một bài đăng trên blog vào thứ Ba. Trong buổi họp báo với các phóng viên, phó chủ tịch phụ trách phần cứng của OpenAI, Richard Ho, cho biết Jalapeño mang lại "lợi ích vẹn cả đôi đường" với độ trễ thấp hơn và lưu lượng xử lý cao hơn, trong khi các hệ thống AI thường "phải đánh đổi giữa hai yếu tố này".

Được giới thiệu lần đầu vào tháng 6, Jalapeño là một loại vi mạch tích hợp chuyên dụng (ASIC) được sản xuất thông qua quan hệ đối tác với Broadcom. Nó được thiết kế cho quá trình suy luận AI (AI inference) — quy trình vận hành một mô hình AI đã được huấn luyện để hoàn thành tác vụ hoặc triển khai một tác nhân (agent).

![This chart measures Jalapeño’s time between tokens (TBT) — or the time it takes to deliver a response.](https://platform.theverge.com/wp-content/uploads/sites/2/2026/08/tbt-jalapeno.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)

Để đo lường hiệu năng của Jalapeño, OpenAI đã sử dụng InferenceX, một nền tảng đo điểm chuẩn cho thấy mức độ xử lý suy luận của các hệ thống AI. Bài kiểm tra đã so sánh hiệu năng của Jalapeño với các kết quả tốt nhất được ghi nhận tại thời điểm đó, vốn thuộc về các siêu chip GB200 hoặc GB300 của Nvidia. OpenAI cho biết Jalapeño mang lại hiệu suất công việc AI trên mỗi watt cao gấp 1,5 đến 1,9 lần trên các mô hình GPT-OSS 120B, DeepSeek R1 và Kimi K2.5 1T so với các hệ thống đối chứng, đồng thời giảm độ trễ từ đầu đến cuối từ 1,7 đến 3,6 lần trên cả ba mô hình. Theo ông Ho, điều này có nghĩa là con chip có thể cung cấp cho người dùng "phản hồi nhanh hơn, các tác nhân phản ứng nhạy bén hơn và khả năng truy cập đáng tin cậy hơn khi nhu cầu tăng cao".

![Jalapeño can perform more work while using less energy, according to OpenAI.](https://platform.theverge.com/wp-content/uploads/sites/2/2026/08/jalapeno-throughput.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)

OpenAI dự kiến sẽ triển khai Jalapeño với "số lượng nhỏ" vào cuối năm nay, nhưng sẽ bắt đầu "tăng dần số lượng" trong năm 2027, ông Ho cho biết thêm. Tuy nhiên, công ty không tiết lộ kế hoạch triển khai bao nhiêu con chip vào năm tới.

Ngay cả với những cải tiến về hiệu năng này, ông Ho cho biết OpenAI không kỳ vọng sẽ thay thế toàn bộ dòng chip hiện tại bằng Jalapeño, đồng thời khẳng định chiến lược tính toán tổng thể của hãng vẫn bao gồm "những đối tác rất tốt" như Nvidia. OpenAI sẽ tiếp tục phát triển thế hệ thứ hai và thứ ba của dòng chip mới này.

Hãy theo dõi các chủ đề và tác giả từ bài viết này để xem thêm các nội dung tương tự trên trang chủ cá nhân của bạn và nhận thông báo qua email.
