22/09

Thứ Ba · 2 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 38/100

Chỉ cần 1% Token: Tối ưu hóa chưng cất chính sách trực tuyến (OPD) bằng lý thuyết thông tin

Nghiên cứu chỉ ra rằng có thể đạt hiệu suất tương đương hoặc vượt trội so với chưng cất toàn phần chỉ với 0,1%-1% token. Bằng cách sử dụng chỉ số hiệu quả thông tin (IER), phương pháp này giúp chọn lọc dữ liệu huấn luyện tối ưu, tiết kiệm tài nguyên đáng kể cho các mô hình ngôn ngữ lớn.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 50/100

Harness-Zero: Kỹ thuật chưng cất khung làm việc cho AI Agent

Harness-Zero giới thiệu phương pháp 'agent-as-harness' giúp chuyển giao hành vi tối ưu từ các khung làm việc phức tạp trực tiếp vào trọng số mô hình, giúp AI duy trì hiệu suất cao ngay cả khi không còn phụ thuộc vào khung hỗ trợ.

18/09

Thứ Sáu · 1 tin
JiQiZhiXin
Nghiên cứuĐiểm AI 88/100

Tinh chọnSamsung ra mắt TrOPD: Đưa trí tuệ AI cao cấp vào thiết bị di động với chi phí tối ưu

Samsung phối hợp cùng Oxford và Đại học Bắc Kinh giới thiệu phương pháp TrOPD, giúp mô hình nhỏ học hỏi hiệu quả từ mô hình lớn thông qua cơ chế 'vùng tin cậy', giải quyết bài toán đưa AI mạnh mẽ lên hàng triệu thiết bị di động mà vẫn tiết kiệm tài nguyên.


Vì sao đáng đọc: Bài viết giải quyết vấn đề thực tế về chi phí và hiệu năng khi triển khai AI trên thiết bị đầu cuối (On-device AI), có phương pháp kỹ thuật rõ ràng và tiềm năng ứng dụng cao.

16/09

Thứ Tư · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Huấn luyện mô hình chuyên gia mà không cần chuỗi suy luận: Giải mã cơ chế chưng cất tri thức

Nghiên cứu chỉ ra rằng các mô hình chuyên gia tự chọn lọc các chuỗi suy luận tiềm ẩn ngay cả khi chỉ được huấn luyện bằng cặp câu hỏi-đáp, mở ra hướng đi mới trong việc tối ưu hóa khả năng suy luận của mô hình nhỏ.

09/09

Thứ Tư · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 37/100

Đột phá mới trong huấn luyện AI: Phương pháp OPRD giúp mô hình học sinh vượt mặt thầy giáo yếu

Phương pháp On-Policy Reverse Distillation (OPRD) cho phép mô hình AI học từ giáo viên yếu nhưng vẫn đạt hiệu suất vượt trội, nhờ cơ chế lọc và khuếch đại các cập nhật tối ưu từ trình xác thực.

07/09

Thứ Hai · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 64/100

Microsoft đề xuất phương pháp chưng cất kỹ năng suy luận: Giúp mô hình nhỏ đạt hiệu suất vượt trội

What if you could pay the reasoning cost once, then reuse what the model learned across future tasks…

DịchNghiên cứu mới từ Microsoft cho phép chuyển đổi chi phí suy luận đắt đỏ thành các 'kỹ năng' dạng Markdown. Bằng cách tổng hợp các mẫu lỗi từ lịch sử, mô hình nhỏ có thể khôi phục 55-100% khả năng suy luận mà không cần tốn thêm token.

03/09

Thứ Năm · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 43/100

Switch Distillation: Tối ưu hóa chưng cất tri thức trong giai đoạn huấn luyện trung gian

Nghiên cứu đề xuất phương pháp Switch Distillation, sử dụng độ bất định của mô hình giáo viên để điều hướng quá trình chưng cất, giúp cải thiện khả năng suy luận mà không làm suy giảm khả năng ghi nhớ sự kiện trong giai đoạn huấn luyện trung gian.

26/08

Thứ Tư · 1 tin

22/08

Thứ Bảy · 1 tin
Nathan Lambert@natolambert
Hướng dẫnĐiểm AI 12/100

Nathan Lambert kêu gọi chia sẻ tài liệu hay về mô hình nguồn mở và cuộc đua AI Mỹ - Trung

What's the best work you've consumed on open models, us v china AI, distillation, or related topics? …

DịchChuyên gia Nathan Lambert đang tìm kiếm các nguồn tài liệu chất lượng như blog, bài báo hay podcast về mô hình nguồn mở, kỹ thuật chưng cất tri thức và sự cạnh tranh AI giữa Mỹ và Trung Quốc.

Tổng 9 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (23 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “chưng cất tri thức” | AIHOT.vn