25/09

Thứ Sáu · 1 tin

23/09

Thứ Tư · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 47/100

KVMEM: Giải pháp tối ưu hóa bộ nhớ cho AI Agent với khả năng xử lý hàng triệu token

A model's context window does not have to be an agent's workspace limit. KVMEM makes million-token …

DịchKVMEM áp dụng kỹ thuật phân trang trạng thái KV cũ giúp AI Agent xử lý hàng triệu token hiệu quả hơn. Công nghệ này cải thiện đáng kể độ chính xác trên DeepSWE và tăng tốc độ truy xuất dữ liệu gấp nhiều lần so với các phương pháp nén truyền thống.

19/09

Thứ Bảy · 2 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 34/100

AgentZip: Giải pháp nén bộ nhớ dùng chung cho các tác nhân AI chạy song song

If 1 agent task launches many sandboxes, manage their memory together AgentZip shows that much of t…

DịchAgentZip tối ưu hóa hiệu suất bằng cách nén các dữ liệu trùng lặp trong bộ nhớ giữa các sandbox tác nhân AI. Công nghệ này giúp giảm tới 88,55% dung lượng bộ nhớ dư thừa khi chạy nhiều tác nhân từ cùng một khuôn mẫu, đặc biệt hiệu quả trong thời gian chờ phản hồi từ LLM.

18/09

Thứ Sáu · 1 tin

17/09

Thứ Năm · 1 tin

12/09

Thứ Bảy · 1 tin
Elvis Saravia@omarsar0
NgànhĐiểm AI 42/100

AgentZip: Giải pháp nén bộ nhớ sandbox cho AI Agent, giảm dung lượng tới 8,7 lần

Very cool paper on memory compression for agents. If you run many agent sandboxes in parallel for R…

DịchCác nhà nghiên cứu từ HKUST giới thiệu AgentZip, kỹ thuật tối ưu hóa bộ nhớ cho các sandbox AI Agent bằng cách loại bỏ dữ liệu dư thừa, giúp giảm mức sử dụng RAM lên đến 8,7 lần mà vẫn duy trì hiệu suất ổn định.

09/09

Thứ Tư · 1 tin
Elvis Saravia@omarsar0
NgànhĐiểm AI 47/100

KVMem: Giải pháp ảo hóa không gian làm việc cho AI Agent với dung lượng triệu token

Nice paper to improve inference efficiency. It's been a while we haven't seen good work on efficien…

DịchKVMem tối ưu hóa bộ nhớ cho AI Agent bằng cách phân trang và lưu trữ trạng thái KV trên GPU, RAM và NVMe. Hệ thống sử dụng cơ chế chỉ mục chú ý để truy xuất thông tin lịch sử liên quan, giúp xử lý ngữ cảnh siêu dài một cách hiệu quả.

02/09

Thứ Tư · 1 tin

31/08

Thứ Hai · 2 tin

29/08

Thứ Bảy · 1 tin
SemiAnalysis@SemiAnalysis_
Hướng dẫnĐiểm AI 28/100

Cú sốc chi phí linh kiện bộ nhớ đã bắt đầu ảnh hưởng trực tiếp đến người tiêu dùng

Everyone's asking whether the memory BOM shock is actually hitting the consumer. It is. And we have…

DịchDữ liệu mới nhất xác nhận rằng sự biến động trong chi phí linh kiện (BOM) của bộ nhớ không còn chỉ nằm ở quy mô sản xuất mà đã bắt đầu tác động trực tiếp đến giá thành sản phẩm cuối cùng trên thị trường.

27/08

Thứ Năm · 2 tin

25/08

Thứ Ba · 1 tin
IT Home
NgànhĐiểm AI 88/100

Tinh chọnGartner dự báo: Thị trường bộ nhớ sẽ vượt tổng doanh thu ngành bán dẫn vào năm 2026

Gartner dự báo thị trường bộ nhớ sẽ bùng nổ đạt 837,3 tỷ USD vào năm 2026, vượt qua tổng doanh thu toàn ngành bán dẫn năm 2025 nhờ sự thúc đẩy mạnh mẽ từ hệ sinh thái trung tâm dữ liệu AI.


Vì sao đáng đọc: Thông tin quan trọng từ Gartner về sự chuyển dịch cán cân quyền lực trong ngành bán dẫn, phản ánh tác động trực tiếp của AI đến nhu cầu phần cứng toàn cầu.

24/08

Thứ Hai · 1 tin

22/08

Thứ Bảy · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Nghiên cứuĐiểm AI 56/100

Giải mã kiến trúc bộ nhớ GPU: Kỹ thuật đảo ngược đường dẫn tải dữ liệu trên RTX 4090

Bài viết thực hiện kỹ thuật đảo ngược đường dẫn phần cứng trên RTX 4090, làm sáng tỏ cơ chế phân mảnh cache L1/L2 và hàm băm địa chỉ phức tạp. Tác giả cung cấp mã nguồn dự đoán phân mảnh cho các dòng GPU cao cấp như 4090 và L40S.

21/08

Thứ Sáu · 1 tin

20/08

Thứ Năm · 1 tin

19/08

Thứ Tư · 2 tin

18/08

Thứ Ba · 1 tin
IT Home
NgànhĐiểm AI 85/100

Lãnh đạo Xiaomi: Giá bộ nhớ sẽ hạ nhiệt trong nửa cuối năm 2026

Chủ tịch Xiaomi Lư Vĩ Băng dự báo đà tăng giá bộ nhớ sẽ chậm lại trong nửa cuối năm 2026 dù chi phí vẫn ở mức cao. Hãng đang tối ưu hóa cấu trúc sản phẩm và tăng giá bán trung bình để duy trì lợi nhuận trong bối cảnh thị trường smartphone và xe điện tăng trưởng mạnh.

14/08

Thứ Sáu · 1 tin
Tổng 23 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (31 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Bộ nhớ” | AIHOT.vn