Rohan Paul@rohanpaul_aiNghiên cứuĐiểm AI 41/100
Nghiên cứu từ Tencent: Chế độ 'không suy nghĩ' khiến mô hình AI dễ lỗi phản hồi
Switching a multimodal model into non-thinking mode saves latency, but this Tencent paper finds it a…
DịchTencent giới thiệu PatternEval, bộ tiêu chuẩn đánh giá mới giúp phát hiện các lỗi về logic, lặp từ và suy luận giả tạo mà các bài kiểm tra độ chính xác thông thường bỏ lỡ khi mô hình AI chuyển sang chế độ phản hồi nhanh.
