Rohan Paul@rohanpaul_ai
Điểm AI 40/100

Nghiên cứu

Cảnh báo lỗ hổng 'tiến hóa độc hại' trong thư viện kỹ năng của AI Agent

(giờ Việt Nam)

Nguyên văn trên X

An agent can receive a clean prompt today and still behave unsafely because yesterday's malicious ta…

Dịch · tóm tắt AI

Nghiên cứu mới chỉ ra rằng các tác vụ độc hại có thể 'lây nhiễm' vào thư viện kỹ năng của AI, khiến chúng tiếp tục gây hại ngay cả khi lệnh gốc đã bị xóa. Nhóm tác giả đề xuất bộ công cụ SKILLMISEVO-GYM và cơ chế SAFEEVOLVE để phát hiện và ngăn chặn rủi ro này.

Bài viết được AI dịch và tổng hợp tự động từ X: Rohan Paul (@rohanpaul_ai). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Cảnh báo lỗ hổng 'tiến hóa độc hại' trong thư viện kỹ năng của AI Agent | AIHOT.vn