You don't necessarily need to see how a powerful AI thinks to copy some of its reasoning ability. …
DịchNghiên cứu mới giới thiệu kỹ thuật Trace Inversion, cho phép huấn luyện mô hình học sinh đạt khả năng suy luận tương đương mô hình gốc chỉ bằng câu hỏi và đáp án, ngay cả khi chuỗi tư duy (CoT) bị ẩn. Chi phí thực hiện cực thấp, đặt ra thách thức lớn về bảo mật mô hình.
DịchJason Liu chia sẻ trải nghiệm về việc vượt qua các giới hạn sandbox trong môi trường AI, mở ra những khả năng mới trong việc tương tác và thực thi tác vụ.
Các nhà nghiên cứu phát hiện lỗ hổng cho phép giải mã và đánh cắp các chuỗi suy luận ẩn của Anthropic, OpenAI và Google thông qua việc phát lại dữ liệu. Dù đã được các nhà cung cấp khắc phục, đây là cảnh báo quan trọng về bảo mật dữ liệu trong các mô hình AI suy luận.
Very big warning from this paper. Your AI's hidden reasoning can become a second, invisible data le…
DịchNghiên cứu mới chỉ ra rằng các khối suy luận ẩn trong AI có thể lưu trữ và làm lộ thông tin nhạy cảm như mật khẩu hay API key ngay cả khi hội thoại đã bị xóa. Kẻ tấn công có thể khai thác các khối này để đánh cắp dữ liệu từ các mô hình mạnh thông qua mô hình yếu hơn.
Our users run over 100, 000 security scans per day with @semgrep Replit has everything you need to b…
DịchReplit vừa tích hợp công cụ Semgrep để tự động quét lỗ hổng bảo mật cho mã nguồn do AI tạo ra ngay lập tức. Hệ thống này giúp loại bỏ hơn 93% cảnh báo sai mà không cần cấu hình phức tạp, đảm bảo an toàn cho lập trình viên.