22/09

Thứ Ba · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 59/100

Dùng thuật toán nén gzip để tạo văn bản: Khi nén dữ liệu thay thế mô hình ngôn ngữ

Lấy cảm hứng từ lý thuyết nén là dự đoán, tác giả đã tạo ra gzipt - một công cụ sử dụng cửa sổ trượt DEFLATE của gzip để dự đoán văn bản mà không cần huấn luyện hay mạng thần kinh.

21/09

Thứ Hai · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 75/100

Tối ưu hóa mã hóa thưa tích chập thích ứng qua nút thắt thông tin cho biểu diễn thị giác

Nghiên cứu đề xuất khung mã hóa thưa tích chập (CSC) có khả năng tự học hệ số thưa thông qua thuật toán FISTA, giúp cân bằng hiệu quả giữa việc nén dữ liệu và bảo toàn thông tin quan trọng cho các tác vụ thị giác máy tính.

20/09

Chủ Nhật · 1 tin
Pandaily
Mô hìnhĐiểm AI 92/100

Tinh chọnDeepSeek-V4.1-Flash ra mắt: Mô hình MoE 552B, cửa sổ ngữ cảnh 1 triệu token và nén KV siêu cấp

DeepSeek-V4.1-Flash là mô hình MoE Encoder-Decoder 552 tỷ tham số, hỗ trợ cửa sổ ngữ cảnh 1 triệu token cùng công nghệ nén KV cực mạnh, hiện đã có mặt trên API dưới tên deepseek-flash.


Vì sao đáng đọc: Đây là bước tiến lớn về kỹ thuật tối ưu hóa bộ nhớ và ngữ cảnh cho các mô hình ngôn ngữ quy mô lớn, thu hút sự quan tâm cao từ cộng đồng AI.

17/09

Thứ Năm · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 74/100

Giải mã DeepSeek-V4.1-Flash: Công nghệ nén KV Cache đột phá chỉ với 890 byte mỗi token

Bài viết phân tích kỹ thuật chuyên sâu về DeepSeek-V4.1-Flash, làm rõ cách thức CED và CSA2 tối ưu hóa bộ nhớ KV Cache, đồng thời đánh giá đây là bước nhảy vọt về kiến trúc tương đương thế hệ V5.

12/09

Thứ Bảy · 1 tin

11/09

Thứ Sáu · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 47/100

GLIE: Phương pháp nhúng tương tác hậu kỳ tạo sinh tối ưu cho truy xuất tài liệu thị giác

GLIE giải quyết bài toán lưu trữ lớn trong truy xuất tài liệu bằng cách sử dụng k vector tâm chuẩn hóa để lập chỉ mục, sau đó dùng bộ giải mã để tái tạo và tái xếp hạng chính xác, giúp tối ưu hóa hiệu suất mà vẫn đảm bảo độ chính xác.

09/09

Thứ Tư · 2 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Cadence: Nén dữ liệu chuỗi thời gian có kiểm soát sai số bằng mô hình nền tảng

Cadence kết hợp mô hình TimesFM-3 với bộ mã hóa số học thích ứng để nén chuỗi thời gian, đảm bảo sai số nằm trong ngưỡng cho phép. Phương pháp này vượt trội hơn các thuật toán truyền thống như xz hay zstd nhờ khả năng tận dụng dự báo chính xác để tối ưu hóa dung lượng lưu trữ.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnBeaconKV: Tối ưu bộ nhớ KV Cache cho mô hình suy luận lớn thông qua truy vấn Beacon

BeaconKV giải quyết nút thắt bộ nhớ khi suy luận dài bằng cách xác định các 'Thought Revisiting Tokens' quan trọng, giúp nén KV cache hiệu quả mà không làm giảm khả năng truy xuất ngữ cảnh xa.


Vì sao đáng đọc: Giải pháp kỹ thuật thực tế, giải quyết vấn đề cấp bách về bộ nhớ GPU cho các mô hình suy luận dài (LRMs), có tính ứng dụng cao trong triển khai thực tế.

04/09

Thứ Sáu · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnLatentPress: Đột phá nén ngữ cảnh trực tiếp vào không gian tiềm ẩn của AI

LatentPress giới thiệu phương pháp nén tài liệu và lịch sử hội thoại thành các token bộ nhớ liên tục, cho phép mô hình AI đọc trực tiếp mà không cần giải mã văn bản, giúp tăng hiệu suất xử lý dữ liệu dài gấp 4-16 lần.


Vì sao đáng đọc: Đây là nghiên cứu quan trọng về tối ưu hóa bộ nhớ cho LLM, giải quyết bài toán nén ngữ cảnh hiệu quả hơn hẳn các phương pháp truyền thống như tóm tắt văn bản hay OCR.

03/09

Thứ Năm · 1 tin

01/09

Thứ Ba · 1 tin

18/08

Thứ Ba · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 47/100

Nghiên cứu từ UPenn: AI thường 'quên' quy tắc người dùng khi nén dữ liệu hội thoại dài

A scary finding from new Pennsylvania Uni paper. AI agents can go off-script in a simple way: they …

DịchNghiên cứu mới chỉ ra rằng các mô hình AI thường quên đi các quy tắc thiết lập khi nén hội thoại dài, dù vẫn nhớ nhiệm vụ chính. Giải pháp đơn giản là sử dụng bộ trích xuất 9B để khôi phục quy tắc, giúp tỷ lệ lưu giữ tăng từ 17% lên hơn 90%.

16/08

Chủ Nhật · 1 tin

13/08

Thứ Năm · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

SkillZip: Nén đồ thị bảo toàn hợp đồng cho thư viện kỹ năng AI có khả năng mở rộng

SkillZip là khung trừu tượng hóa thủ tục giúp nén các thư viện kỹ năng của AI dưới dạng đồ thị, cho phép tái sử dụng hiệu quả các đoạn mã mà vẫn đảm bảo tính thực thi và khả năng mở rộng trong bối cảnh hạn chế của LLM.

12/08

Thứ Tư · 1 tin
Tổng 15 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (30 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Nén dữ liệu” | AIHOT.vn