# Grouped Value Attention: Tối ưu hóa bộ nhớ KV Cache bằng kỹ thuật tái tạo khóa theo yêu cầu

- Nguồn: Hugging Face Daily Papers
- Thời gian phát hành: 2026-09-15 07:00 (giờ Việt Nam)
- Điểm AI: 85/100
- Link AIHOT.vn: https://aihot.vn/items/59f215ad11928aa9
- Link gốc: https://arxiv.org/abs/2609.13285

## Tóm tắt AI

GVA là phương pháp mới giúp giảm 45-47% dung lượng bộ nhớ KV cache bằng cách tái tạo khóa nội dung thông qua ánh xạ tuyến tính, thay vì lưu trữ toàn bộ, giúp tăng hiệu suất giải mã cho các mô hình Transformer.

## Thân bài

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite

### Lịch sử gửi bài

Từ: Vishesh Tripathi [xem email] [v1] Thứ Ba, ngày 8 tháng 9 năm 2026 17:58:44 UTC (10.184 KB)
