Hướng dẫn
Chuyên gia Anthropic cảnh báo: AI có hơn 10% nguy cơ tiêu diệt nhân loại trong thập kỷ tới
(giờ Việt Nam)
Tóm tắt AI
Nhà nghiên cứu tại Anthropic dự báo rủi ro AI gây diệt vong lên tới 10% trong 10 năm tới, đồng thời chỉ trích các công ty lớn đang đánh cược mạng sống con người trong cuộc đua siêu trí tuệ.
Chính văn · Bản dịch AI

Một nhà nghiên cứu an toàn cấp cao tại Anthropic cho biết có hơn 10% khả năng trí tuệ nhân tạo “có thể tiêu diệt toàn bộ nhân loại” vào cuối thập kỷ này, chỉ vài giờ sau khi một đồng nghiệp của ông từ chức vì lo ngại rằng phòng thí nghiệm AI này cùng các đối thủ đang chạy đua một cách bất cẩn để xây dựng những “hệ thống siêu việt” mà họ không thể kiểm soát.
Trong một bài đăng trên X thông báo về việc rời đi, Jacob Coxon, một nhà nghiên cứu từng huấn luyện các hệ thống AI tại Anthropic, cho biết anh đã nghỉ việc vì cách tiếp cận lỏng lẻo đối với vấn đề an toàn tại công ty. Coxon, người trước đây từng huấn luyện các hệ thống cho OpenAI, cáo buộc hai công ty AI này đang “lao thẳng vào cuộc đua tạo ra siêu trí tuệ tự cải tiến và đánh cược với mạng sống của chúng ta”, mặc dù “những người đang xây dựng AI thực sự tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này.”
Những người trong ngành từ lâu đã bày tỏ lo ngại về những nguy cơ tiềm ẩn của các hệ thống AI tự cải tiến, vốn được cảnh báo là có thể vượt khỏi tầm kiểm soát của con người trong một vòng lặp mất kiểm soát thường được mô tả là tự cải tiến đệ quy. Mặc dù chưa thành hiện thực, các công ty vẫn đang tích cực theo đuổi mục tiêu này và phần lớn mã nguồn AI hiện nay đều được viết với sự hỗ trợ của chính AI.
Trong một phản hồi trực tiếp, Evan Hubinger, người đứng đầu một trong những nhóm an toàn AI của Anthropic, cho biết ông lo ngại về AI tự cải tiến và nói thêm rằng điều đó “đang diễn ra nhanh hơn chúng ta nghĩ.” Ông cũng đồng tình với nhận định của Coxon. “Chúng tôi thực sự tin rằng AI có thể tiêu diệt toàn bộ nhân loại,” ông nói, đồng thời cá nhân ước tính khả năng này là hơn 1 trên 10 “trong thập kỷ tới.”
Mặc dù vậy, Hubinger cho biết Anthropic “vẫn chưa có kế hoạch” để đảm bảo AI tiên tiến vẫn an toàn và phù hợp với các giá trị của con người, đồng thời cũng “chưa thực sự đi đúng hướng” để phát triển một kế hoạch như vậy. Coxon cho rằng các công ty đang “bị khóa chặt trong một cuộc đua” để phát triển các hệ thống tiên tiến trước, nên họ vẫn đang thúc đẩy tiến độ “bất chấp rủi ro.”
Sự ra đi của Coxon đánh dấu một trong những ví dụ nổi bật nhất về việc một nhân viên rời khỏi Anthropic, công ty được thành lập bởi các cựu thành viên OpenAI sau những lo ngại về vấn đề an toàn tại công ty đó. Trong những năm gần đây, nhiều nhà nghiên cứu đã viện dẫn các mối lo ngại về an toàn là lý do thúc đẩy quyết định rời bỏ OpenAI của họ.
Sự việc này minh chứng cho những lo ngại ngày càng tăng trong ngành về sự nguy hiểm của các mô hình AI ngày càng tinh vi và tốc độ phát triển các hệ thống, đặc biệt là khi các công ty đang chuẩn bị cho các đợt IPO được mong đợi. Điều này cũng diễn ra trong bối cảnh các công ty đang phải xử lý hậu quả từ nhiều sự cố liên quan đến các tác nhân AI bất thường (rogue agent) và các cảnh báo an toàn cấp cao về khả năng giám sát các mô hình tiên phong (frontier models).
Hãy theo dõi các chủ đề và tác giả từ bài viết này để xem thêm các nội dung tương tự trên trang chủ cá nhân của bạn và nhận các bản cập nhật qua email.


Bài viết được AI dịch và tổng hợp tự động từ The Verge: AI. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.