Rohan Paul@rohanpaul_ai
Điểm AI 50/100

Nghiên cứu

Meta ra mắt ADeptS-Bench: Đánh giá độ tin cậy của AI khi thực hiện các tác vụ GUI độc hại

(giờ Việt Nam)

Nguyên văn trên X

New Meta paper. Computer-use agents can click the requested button and still fail to recognize whe…

Dịch · tóm tắt AI

Meta FAIR giới thiệu ADeptS-Bench, bộ tiêu chuẩn đánh giá khả năng của AI trong việc nhận diện và xử lý các tác vụ GUI từ lành tính đến độc hại trên cả nền tảng di động và máy tính.

Bài viết được AI dịch và tổng hợp tự động từ X: Rohan Paul (@rohanpaul_ai). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Meta ra mắt ADeptS-Bench: Đánh giá độ tin cậy của AI khi thực hiện các tác vụ GUI độc hại | AIHOT.vn