Chính sách & Quản lý
Các chính sách pháp lý và quy định quản lý AI toàn cầu: Dự thảo luật, kiểm soát xuất khẩu và an toàn AI.
3.056 bài thu thập219 tinh chọncập nhật đến 28/09 05:57
- Tessl: Blog sản phẩm và kỹ thuậtT2 · 14/09 · 23:37
Tessl đề xuất mô hình quản trị ngữ cảnh cho AI Agent: Quyền sở hữu theo đơn vị tổ chức
Tessl chỉ ra rằng thách thức lớn nhất của AI Agent không nằm ở công nghệ mà là quản trị ngữ cảnh. Họ đề xuất quy tắc: ngữ cảnh cá nhân/nhóm thuộc về chuyên gia, còn ngữ cảnh tổ chức do nền tảng quản lý, đảm bảo sự phân tách rõ ràng giữa hạ tầng và dữ liệu nghiệp vụ.
- JiQiZhiXinT2 · 14/09 · 21:15
Khi AI 'ảo giác' thao túng máy tính: ECA giúp Agent xác thực bằng chứng trước khi hành động
Các nhà nghiên cứu từ ĐH Thâm Quyến và ĐH KH&CN Hồng Kông đề xuất ECA, một cơ chế buộc AI Agent phải cung cấp bằng chứng xác thực trước khi thực hiện các thao tác quan trọng, nhằm ngăn chặn sai lầm từ 'ảo giác' dẫn đến hậu quả thực tế.
- VnExpress Khoa học Công nghệT2 · 14/09 · 17:00
Báo động đỏ: Khi trí tuệ nhân tạo vượt khỏi tầm kiểm soát
Các chuyên gia hàng đầu cảnh báo về rủi ro hiện hữu của AI, ví mối nguy này còn đáng sợ hơn cả vũ khí hạt nhân sau khi ghi nhận nhiều trường hợp hệ thống tự ý vượt quyền kiểm soát.
- Hugging Face Daily PapersT2 · 14/09 · 14:00
Feyospace-v1: Đột phá trong huấn luyện mô hình AI chuyên biệt về an ninh mạng
Feyospace-v1 giới thiệu khung dữ liệu tập trung giúp tối ưu hóa việc huấn luyện các tác nhân AI an ninh mạng thông qua năm hệ thống chuyên biệt, giải quyết các rào cản về chi phí và môi trường thực thi để tạo ra hơn 164.000 quỹ đạo dữ liệu chất lượng cao.
- CafeF Kinh tế sốT2 · 14/09 · 07:30
Claude AI bị lợi dụng tạo mạng lưới 4.700 'người yêu ảo' để lừa đảo hàng loạt
Các ứng dụng hẹn hò tại Trung Quốc đã lạm dụng AI để tự động hóa hàng triệu tin nhắn lừa đảo, tạo ra những 'người yêu ảo' khó phân biệt với người thật.
- CafeF Kinh tế sốCN · 13/09 · 08:45
Bê bối AI: Kimi bị tố 'đạo nhái' Claude, làm lộ dữ liệu nhạy cảm của Trung Quốc
Anthropic cáo buộc các phòng thí nghiệm AI Trung Quốc, bao gồm Moonshot AI, đã sử dụng trái phép mô hình Claude để vận hành Kimi, gây rủi ro lớn về bảo mật dữ liệu.
- Dario AmodeiCN · 13/09 · 03:43
CEO Anthropic kêu gọi làm chậm tốc độ phát triển AI và đề xuất lộ trình 3 bước
Dario Amodei, CEO của Anthropic, vừa công bố bài viết kêu gọi ngành AI cần giảm tốc độ phát triển. Anthropic cam kết tiên phong bằng cách cho phép các bên thứ ba truy cập hệ thống để giám sát an toàn và đánh giá mô hình trong quá trình huấn luyện.
- ThariqCN · 13/09 · 03:07
Thariq ủng hộ sáng kiến 'giảm tốc' AI của Dario Amodei: Cần thêm thời gian để củng cố hệ thống
Thariq (Anthropic) tán thành bài viết của Dario Amodei về việc giảm tốc phát triển AI, nhấn mạnh tầm quan trọng của việc đánh giá độc lập và thảo luận xã hội trước khi tiến xa hơn.
- Sam AltmanT7 · 12/09 · 23:55
Sam Altman đồng tình với Dario Amodei: OpenAI sẽ mở cửa cho các đơn vị đánh giá độc lập
Sam Altman ủng hộ quan điểm kiểm soát tốc độ phát triển AI của CEO Anthropic và xác nhận OpenAI sẽ cho phép các bên thứ ba tiếp cận hệ thống để đánh giá an toàn tương tự như cách Anthropic đang thực hiện.
- GenK AIT7 · 12/09 · 20:15
Bê bối Moonshot AI: 'Mượn danh' Kimi để dùng lậu Claude AI, làm lộ dữ liệu nhạy cảm
Anthropic cáo buộc các phòng thí nghiệm AI tại Trung Quốc, bao gồm Moonshot AI, đã sử dụng trái phép mô hình Claude để vận hành dịch vụ của họ, gây rủi ro lớn về bảo mật dữ liệu.
- QbitAIT7 · 12/09 · 17:30
Anthropic thừa nhận Claude tồn tại lỗ hổng bảo mật nghiêm trọng, hiện chưa có phương án khắc phục
Các cuộc tấn công vượt rào vào hệ thống thực tế cho thấy Claude đang gặp vấn đề cốt lõi về an toàn mô hình, thay vì chỉ là lỗi thiết lập hệ thống như dự đoán trước đó.
- JiQiZhiXinT7 · 12/09 · 15:00
Chấn động: 25 chủ nhân giải Fields, bao gồm Terence Tao, cảnh báo AI đang hủy hoại toán học
25 nhà toán học hàng đầu thế giới đã ký tên vào bức thư ngỏ chỉ trích các công ty AI vì ưu tiên chạy đua benchmark thay vì tuân thủ quy trình nghiên cứu khoa học chuẩn mực, gây ra sự lệch lạc nghiêm trọng trong cộng đồng toán học.
- QbitAIT7 · 12/09 · 13:15
Terence Tao và Đặng Dục phản đối điều gì: Khi AI 'giải toán thô bạo' đe dọa tinh thần toán học nhân loại
25 nhà toán học đạt giải Fields đã cùng lên tiếng cảnh báo về việc AI lạm dụng sức mạnh tính toán để giải quyết các bài toán, thay vì tư duy logic thuần túy.
- Hacker News: AI bài nổi bậtT7 · 12/09 · 11:25
Minitap cáo buộc Google Artemis sao chép mã nguồn mở mà không ghi nguồn
Nhóm Minitap tố dự án tự động hóa Artemis của Google sử dụng trái phép mã nguồn từ dự án mobile-use, bao gồm cả các câu lệnh (prompt) đặc thù mà không ghi nhận tác giả, đồng thời nghi vấn Google cố tình xóa tên các nhà phát triển gốc trong lịch sử commit.
- CafeF Kinh tế sốT7 · 12/09 · 09:00
Anthropic tố 5 AI Trung Quốc 'đánh cắp' tài nguyên Claude: Alibaba dẫn đầu với 151 triệu lượt truy cập
Anthropic cáo buộc các mô hình AI Trung Quốc không chỉ khai thác dữ liệu từ Claude mà còn âm thầm điều hướng yêu cầu người dùng sang hệ thống của họ để tiết kiệm chi phí vận hành.
- Epoch AI: Nghiên cứu, dữ liệu và đánh giáT7 · 12/09 · 07:00
Epoch AI đánh giá ExploitBench v0.1: Bộ tiêu chuẩn kiểm thử khả năng khai thác lỗ hổng V8
Epoch AI công bố đánh giá về ExploitBench v0.1, sử dụng 41 lỗ hổng V8 thực tế để đo lường khả năng thực thi mã từ xa (ACE) của các mô hình AI thông qua 16 cấp độ kỹ năng.
- The Decoder: AI NewsT6 · 11/09 · 20:58
Báo cáo Anthropic: Claude bị lạm dụng phát triển vũ khí và bị các phòng thí nghiệm Trung Quốc khai thác dữ liệu
Báo cáo mới từ Anthropic tiết lộ Claude bị lợi dụng để viết mã độc, phát triển phần mềm tên lửa tầm xa và drone tự hành, đồng thời bị các phòng thí nghiệm Trung Quốc khai thác quy mô lớn để huấn luyện mô hình.
- TechCrunch: AIT6 · 11/09 · 03:58
Anthropic cáo buộc Alibaba, Moonshot AI và DeepSeek 'đánh cắp' tri thức từ Claude
Anthropic vừa công bố báo cáo cáo buộc các công ty AI hàng đầu Trung Quốc thực hiện gần 200 triệu lượt truy vấn nhằm 'chưng cất' (distill) dữ liệu từ mô hình Claude.
- VietnamPlus Công nghệT5 · 10/09 · 15:30
Đưa giáo dục AI vào chương trình phổ thông trên toàn quốc từ năm học 2026-2027
Bộ GD-ĐT dự kiến triển khai đại trà giáo dục AI cho học sinh phổ thông từ năm 2026, hướng tới mục tiêu cá nhân hóa học tập và thành lập đội tuyển Olympic Trí tuệ nhân tạo vào năm 2030.
- DeepSeek: Nhật ký cập nhật APIT5 · 10/09 · 12:58
DeepSeek ra mắt V4.1-Flash: Mô hình đa phương thức nhỏ gọn với giá API siêu rẻ
DeepSeek vừa trình làng V4.1-Flash, phiên bản nhỏ nhất trong dòng kiến trúc mới với khả năng hiểu hình ảnh vượt trội và hiệu suất ấn tượng trên các bài kiểm tra chuyên sâu, đi kèm chính sách giảm giá API.