Ngành
Nghi vấn gian lận điểm chuẩn trên Gemini 3.8 Flash và Muse Spark 1.3
(giờ Việt Nam)
Nguyên văn trên X
Gemini 3.8 Flash and Muse Spark 1.3 are two of the most clearly benchmaxxed models we've seen yet. D…
Dịch · tóm tắt AI
Gemini 3.8 Flash và Muse Spark 1.3 đang gây tranh cãi khi cho thấy dấu hiệu tối ưu hóa quá mức trên các bài kiểm tra chuẩn, dẫn đến sự sụt giảm hiệu suất đáng kể khi chuyển từ Terminal Bench 2.1 sang 4.0.

Bài viết được AI dịch và tổng hợp tự động từ X: SemiAnalysis (@SemiAnalysis_). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.