Ma Dongxi NLP@dongxi_nlp
Điểm AI 58/100

Mô hình

DeepSeek ra mắt DeepSeek-V4.1-Flash: Đột phá kiến trúc CED tối ưu bộ nhớ KV cache

(giờ Việt Nam)

Tóm tắt AI

DeepSeek-V4.1-Flash là mô hình MoE đa phương thức 552B tham số, sử dụng kiến trúc CED và kỹ thuật FP4 giúp giảm dung lượng KV cache xuống mức cực thấp, hỗ trợ ngữ cảnh lên tới 1 triệu token với hiệu suất vượt trội.

Nguồn này chưa có thân bài hiển thị được, trang chỉ có tóm tắt.

Xem trên X (mở trong thẻ mới)

Bài viết được AI dịch và tổng hợp tự động từ X: Ma Dongxi NLP (@dongxi_nlp). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Xem toàn bộ
Fireworks ra mắt DeepSeek-V4.1-Flash, đạt trình độ DeepSWE ngang ngửa GPT-6 Astra với chi phí chỉ bằng 1/15
DeepSeek ra mắt DeepSeek-V4.1-Flash: Đột phá kiến trúc CED tối ưu bộ nhớ KV cache | AIHOT.vn