Mô hình
Artificial Analysis cập nhật chỉ số Coding Agent: Bổ sung báo cáo từ chối an toàn
(giờ Việt Nam)
Nguyên văn trên X
Safety refusal reporting is now available in the Artificial Analysis Coding Agent Index In our late…
Dịch · tóm tắt AI
Artificial Analysis vừa bổ sung báo cáo từ chối an toàn vào Coding Agent Index v1.5 để làm rõ hành vi của các mô hình. Đáng chú ý, Claude Fable 5.1 ghi nhận tỷ lệ 'fallback' cao nhất trên Claude Code và Devin Fusion, ảnh hưởng trực tiếp đến kết quả đánh giá.

Bài viết được AI dịch và tổng hợp tự động từ X: Artificial Analysis (@ArtificialAnlys). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.