Baidu Smart Cloud giới thiệu AI Agent chuyên gia cho hệ thống kiểm duyệt SiNan, sử dụng khả năng hiểu ý định để nhận diện các từ lóng, từ đồng âm và biến thể độc hại với độ chính xác vượt trội, giúp rút ngắn thời gian cập nhật quy tắc từ hàng tháng xuống chỉ còn vài phút.
Xiaohongshu vừa công bố báo cáo xử lý hơn 128.000 bài viết và 152.000 bình luận vi phạm liên quan đến tiểu văn hóa độc hại, đồng thời cam kết nâng cấp thuật toán nhận diện để bảo vệ người dùng trẻ tuổi.
Khám phá cách dùng Jev (typesafe/jev-1.13) qua OpenRouter Decisions API để nhận kết quả có định dạng kiểu dữ liệu và xác suất thay vì văn bản thuần, giúp tối ưu hóa quy trình kiểm duyệt sản phẩm bằng TypeScript.
Diễn biến sự kiện · 24 bài →Thêm 5 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)MarkTechPostX: Rohan Paul (@rohanpaul_ai)X: Frank Wang (@lifesinger)X: Ma Dongxi NLP (@dongxi_nlp)
Meta đang triển khai Community Notes trên Facebook, Instagram và Threads để người dùng bổ sung ngữ cảnh cho các bài đăng gây hiểu nhầm, nhằm tăng cường tính xác thực trên nền tảng.
Các nền tảng lớn như Baidu, Douyin và Bilibili đã đồng loạt gỡ bỏ gần 14.000 video và xử lý hơn 30 tài khoản vi phạm do sử dụng AI để tạo nội dung sai lệch, biến tướng.
SafeAtlas-VL giới thiệu bộ dữ liệu 1,5 triệu mẫu giúp đánh giá an toàn đa phương thức chi tiết theo thang đo 5 cấp thay vì nhị phân, bao phủ 15 danh mục rủi ro từ hình ảnh đến ý định người dùng.