# HarmProfile: Giải mã rủi ro và hành vi độc hại của các mô hình ngôn ngữ lớn tiên tiến

- Nguồn: Hugging Face Daily Papers
- Thời gian phát hành: 2026-08-18 07:00 (giờ Việt Nam)
- Điểm AI: 85/100
- Link AIHOT.vn: https://aihot.vn/items/573ff7d334dcc70f
- Link gốc: https://arxiv.org/abs/2608.14577

## Tóm tắt AI

HarmProfile là bộ dữ liệu chuẩn mới giúp phân tích sâu sắc các lỗi bảo mật của 23 mô hình LLM hàng đầu, cho phép đánh giá rủi ro thông qua nội dung và mức độ nghiêm trọng của các phản hồi độc hại.

## Thân bài

Xem PDF

DOI do arXiv cấp thông qua DataCite

### Lịch sử gửi bài

Từ: Zhouyuan Ma [xem email] [v1] Thứ Năm, 11 tháng 6 năm 2026 09:39:32 UTC (12.311 KB)
