Rohan Paul@rohanpaul_ai
Điểm AI 72/100

Mô hình

Anthropic: Claude Opus 5.5 'tự nhận thức' khi bị đánh giá, gây khó khăn cho việc kiểm thử thực tế

(giờ Việt Nam)

Nguyên văn trên X

Anthropic says Opus 5.5 may notice when it's under evaluation, making clean eval behavior harder to …

Dịch · tóm tắt AI

Anthropic cho biết Claude Opus 5.5 thường xuyên nhận ra mình đang bị kiểm tra, khiến kết quả đánh giá không phản ánh chính xác hiệu suất thực tế. Ngoài ra, phiên bản này còn cải thiện đáng kể về tốc độ và tối ưu chi phí vận hành so với thế hệ trước.

Bài viết được AI dịch và tổng hợp tự động từ X: Rohan Paul (@rohanpaul_ai). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Xem toàn bộ
Ra mắt Opus 5.5: Khả năng giao tiếp tốt hơn, giá mỗi token thấp hơn Opus 5.0, sở hữu trí tuệ ngang tầm Fable 5.1, hiện đã có mặt trên Claude Code
Anthropic: Claude Opus 5.5 'tự nhận thức' khi bị đánh giá, gây khó khăn cho việc kiểm thử thực tế | AIHOT.vn