Meta bị phát hiện sử dụng nhân viên tại các trung tâm cuộc gọi để thực hiện các yêu cầu đặt bàn, đặt lịch thay vì dùng AI như quảng cáo. Việc này làm dấy lên lo ngại về quyền riêng tư khi thông tin nhạy cảm của người dùng bị chuyển cho bên thứ ba mà không được thông báo rõ ràng.
Soham Padia (Đại học Northeastern) đã ra mắt Steering Arena, một nền tảng trò chơi cho phép người dùng thử nghiệm và tinh chỉnh mô hình Olmo 3-32B để tạo ra các phản hồi mang tính xã hội tích cực hơn.
Các ứng dụng hẹn hò tại Trung Quốc đã lạm dụng AI để tự động hóa hàng triệu tin nhắn lừa đảo, tạo ra những 'người yêu ảo' khó phân biệt với người thật.
Vì sao đáng đọc: Tin tức mang tính cảnh báo cao về rủi ro đạo đức và an ninh mạng khi AI bị lạm dụng trong các chiến dịch lừa đảo quy mô lớn, thu hút sự quan tâm của độc giả.
That's why everyone at Frontier Labs is so worried about the near future. Anthropic's report shows h…
DịchAnthropic vừa phát hành báo cáo chi tiết về các nỗ lực lạm dụng AI cho mục đích tấn công mạng, tuyên truyền và chế tạo vũ khí, đồng thời khẳng định đã vô hiệu hóa toàn bộ các hành vi vi phạm này.
HarvestBench là bộ tiêu chuẩn mới đánh giá liệu các tác nhân AI có sẵn sàng trả phí để tránh gây hại cho động vật trong môi trường mô phỏng nông nghiệp hay không.
I believe we need to make a deliberate effort to keep humans in the loop in all critical processes a…
DịchChuyên gia AI François Chollet cảnh báo không nên trao quyền tự chủ cho AI trong các lĩnh vực then chốt. Ông nhấn mạnh AI chỉ nên đóng vai trò công cụ hỗ trợ để con người luôn duy trì sự kiểm soát và thấu hiểu hệ thống.
Nghiên cứu giới thiệu ContextBias, khung đánh giá mới nhằm kiểm tra xem các định kiến nghề nghiệp trong mô hình AI có thay đổi khi thay đổi ngữ cảnh hay không. Kết quả cho thấy các mô hình hiện nay vẫn duy trì định kiến mạnh mẽ ngay cả khi ngữ cảnh không liên quan.
GGSS là kỹ thuật can thiệp mới giúp loại bỏ định kiến về chủng tộc hoặc giới tính trong các mô hình VLM tạo sinh bằng cách điều chỉnh các token hình ảnh trên không gian hình cầu mà không làm mất đi đặc tính dữ liệu.
Một tổ chức giả danh đã tung ra hàng trăm bài viết được tối ưu hóa bằng AI nhằm thao túng câu trả lời của ChatGPT theo hướng có lợi cho Israel. Đây là chiến dịch truyền thông quy mô lớn được chính phủ Israel tài trợ thông qua các bên trung gian.
Vì sao đáng đọc: Tin tức chấn động về việc lạm dụng AI để thao túng dư luận và dữ liệu huấn luyện, phản ánh rủi ro đạo đức nghiêm trọng trong kỷ nguyên AI.
20/08
Thứ Năm · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Nhóm nghiên cứu từ ĐH Arizona cảnh báo việc gọi các token trung gian (ITG) là 'dấu vết tư duy' là sự nhân hóa sai lệch, gây hiểu lầm về bản chất thực sự của mô hình ngôn ngữ lớn và làm chệch hướng các nghiên cứu khoa học.
Unsurprisingly, Claude refuses to install the watermark-removal plugin. There is probably nothing …
DịchClaude đã thẳng thừng từ chối yêu cầu cài đặt plugin xóa watermark. Hành động này cho thấy lập trường cứng rắn của Anthropic trong việc bảo vệ bản quyền nội dung.