20/09

Chủ Nhật · 1 tin
IT Home
NgànhĐiểm AI 66/100

Anthropic và Accenture bắt tay đầu tư 2 tỷ USD để kiểm định an toàn AI

Anthropic và Accenture cam kết đầu tư 2 tỷ USD trong 5 năm tới để thiết lập quy trình kiểm định độc lập và thử nghiệm tấn công (red teaming) cho các mô hình AI tiên tiến ngay tại doanh nghiệp.

Diễn biến sự kiện · 12 bài →Thêm 3 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)TechCrunch: AIThe Verge: AI

10/09

Thứ Năm · 1 tin
Epoch AI: Nghiên cứu, dữ liệu và đánh giá
Nghiên cứuĐiểm AI 60/100

Tinh chọnĐánh giá HealthBench Professional: Epoch AI chỉ ra 50% tác vụ kiểm thử bị lỗi

Epoch AI đã thực hiện kiểm định độc lập trên bộ tiêu chuẩn HealthBench Professional của OpenAI và phát hiện một nửa trong số 50 tác vụ được lấy mẫu ngẫu nhiên gặp vấn đề nghiêm trọng về chất lượng.


Vì sao đáng đọc: Đây là báo cáo quan trọng về tính minh bạch và độ tin cậy của các bộ tiêu chuẩn đánh giá AI trong lĩnh vực y tế, thu hút sự quan tâm lớn từ giới nghiên cứu.

18/08

Thứ Ba · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 54/100

Ventor-QTest: Phương pháp kiểm định bảo mật cho API mô hình ngôn ngữ lớn dựa trên mô hình đe dọa

Ventor-QTest giới thiệu kỹ thuật kiểm định hộp đen mới giúp đánh giá độ tin cậy của các API mô hình lớn mà không cần truy cập xác suất đầu ra, thông qua việc đo lường tổn thất độ trung thực trung bình và cực hạn để phát hiện rủi ro trong các tác vụ thông minh dài hạn.

Tổng 3 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (13 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Kiểm định mô hình” | AIHOT.vn