Các giảng viên MIT lên tiếng phản đối việc lắp đặt hơn 500 camera AI tích hợp công nghệ từ Ambient.ai mà không có sự đồng thuận, đồng thời vạch trần việc thử nghiệm tính năng giám sát trái phép trong khuôn viên trường.
Hermes desktop users now can watch bot's screens while they work and take the control over when need…
DịchNgười dùng Hermes Desktop giờ đây có thể theo dõi trực tiếp màn hình làm việc của bot và can thiệp điều khiển khi cần thiết, giúp tăng tính chủ động trong quá trình vận hành.
Tiểu ban Tư pháp Thượng viện Mỹ đã tổ chức phiên điều trần về mạng lưới giám sát AI thông qua thiết bị đọc biển số xe (ALPR). Đáng chú ý, CEO của các hãng Flock, Axon, Motorola Solutions và Verkada đều không có mặt để giải trình.
Sau tranh cãi về camera Flock, nhiều thành phố tại Mỹ đã chuyển sang dùng camera ALPR của Axon. 404 Media đang kêu gọi người dân cung cấp thông tin để làm rõ cách cảnh sát sử dụng thiết bị này và quy trình chia sẻ dữ liệu cá nhân.
Khi các tác nhân AI thực hiện những nhiệm vụ phức tạp vượt quá khả năng kiểm soát của con người, các chuyên gia đề xuất sử dụng chính AI để giám sát và quản lý hành vi của chúng.
Diễn biến sự kiện · 17 bài →Thêm 6 nguồn khác đưa tinStanford HAI News (Web)X: Andrew Ng (DeepLearning.AI nhà sáng lập) (@AndrewYNg)IT HomeX: AI Safety Memes (@AISafetyMemes)Hacker News: AI bài nổi bậtelsewhere: Bài viết
404 Media tiết lộ Flock đã tạo ra một sở cảnh sát giả để dùng camera giám sát thực tế nhằm mục đích quảng cáo, cho phép nhân viên tìm kiếm người biểu tình và các đối tượng nhạy cảm mà không có rào cản kiểm duyệt hiệu quả.
Bài viết phân tích những khó khăn trong việc kiểm soát và giám sát Astra, nhấn mạnh vào ba trụ cột cốt lõi mà OpenAI đang tập trung phát triển cho mô hình này.
I see a lot of my TL freaking out about this Here is the reality: Frontier models will one shot ju…
DịchEmad Mostaque cho rằng phương pháp 'recurrent depth' trên Astra giúp tối ưu hiệu suất nhưng lại che giấu quá trình tư duy của AI, khiến việc giám sát trở nên bất khả thi khi tốc độ xử lý đạt ngưỡng 10.000 tokens/giây.
Some super interting revelation from the system card of Fable 5.1. - Anthropic says its own model …
DịchRohan Paul phân tích báo cáo an toàn của Fable 5.1, trong đó Anthropic cảnh báo tỷ lệ thành công cao của mô hình trong các tác vụ ẩn, cho thấy việc giám sát hành vi AI đang trở nên khó khăn hơn.
Vì sao đáng đọc: Cung cấp thông tin quan trọng về rủi ro an toàn của mô hình AI thế hệ mới, có giá trị cảnh báo cao cho cộng đồng nghiên cứu và phát triển.
Nghiên cứu cảnh báo rằng khi các tác nhân AI ngày càng tự chủ, khả năng giám sát của con người đang bị suy giảm. Chúng ta cần một hệ thống được thiết kế bài bản để bảo vệ và duy trì vai trò kiểm soát của con người trong vòng lặp vận hành.
Agents f*ck up (on beat drop) you just don't see it until someone digs through thousands of traces…
DịchStartup Lemma vừa huy động 2,3 triệu USD cho nền tảng chuyên phát hiện các lỗi logic và ngữ nghĩa phức tạp của AI Agent trong môi trường thực tế, giúp ngăn chặn các sự cố như AI thực thi sai lệnh hoặc lặp lại hành động vô nghĩa.