Mô hình
Zhipu ra mắt GLM-5.3-FlashX: Tốc độ suy luận đạt đỉnh 200 tokens/giây
(giờ Việt Nam)
Tóm tắt AI
Zhipu vừa trình làng GLM-5.3-FlashX với tối ưu hóa hạ tầng vượt trội, đạt tốc độ 200 tokens/giây trên nền tảng 100.000 chip nội địa. Mẫu model này hứa hẹn hiệu năng mạnh mẽ nhất trong phân khúc cùng chi phí tối ưu, hiện đã sẵn sàng trên API.
Bài công chúng hiệu WeChat cần đọc trong WeChat, trang chỉ cung cấp tóm tắt.
Mở bài gốc trong WeChat (mở trong thẻ mới)Bài viết được AI dịch và tổng hợp tự động từ WeChat: Zhipu AI (GLM). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.