15/09

Thứ Ba · 1 tin
Trail of Bits: Nghiên cứu an toàn AI
Hướng dẫnĐiểm AI 60/100

Tinh chọnTrail of Bits chỉ trích báo cáo AI của 1Password là gây hiểu lầm, công bố bộ kiểm chứng mới

Trail of Bits cho rằng báo cáo của 1Password về khả năng tự sửa lỗi của AI bị sai lệch do thiết kế thử nghiệm thiếu khách quan. Họ đã công bố hai bản vá mới để đánh giá chính xác hơn năng lực thực tế của các tác nhân AI.


Vì sao đáng đọc: Tin tức chuyên sâu về kiểm chứng AI, vạch trần các lỗ hổng trong phương pháp luận của doanh nghiệp lớn, có giá trị cao cho cộng đồng kỹ thuật.

18/08

Thứ Ba · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 55/100

Nghiên cứu mới: Quy trình 'Kiểm toán - Sửa lỗi' giúp giảm tỷ lệ báo động giả cho LLM

Nghiên cứu trên ProcessBench chỉ ra rằng việc đưa quy trình 'kiểm toán - sửa lỗi' vào ngữ cảnh giúp LLM giảm 9-25% tỷ lệ báo động giả. Kết quả cho thấy mô hình không mất khả năng phân biệt mà chỉ điều chỉnh ngưỡng phán đoán, giúp việc kiểm chứng trở nên chính xác và hiệu quả hơn.

Tổng 2 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (9 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Kiểm chứng AI” | AIHOT.vn