Rohan Paul@rohanpaul_ai
Điểm AI 43/100

Hướng dẫn

EdgeBench: Các AI Agent mạnh nhất chỉ đạt 51,3 điểm sau 12 giờ thử thách

(giờ Việt Nam)

Nguyên văn trên X

Another long-horizon benchmark, another reminder that current AI can work for hours and still remain…

Dịch · tóm tắt AI

Trong bài kiểm tra EdgeBench kéo dài 12 giờ, các mô hình AI hàng đầu chỉ đạt 51,3/100 điểm dù có khả năng tự sửa lỗi và chạy mô phỏng. Kết quả cho thấy hiệu suất của AI vẫn gặp ngưỡng bão hòa dù được cung cấp môi trường tương tác liên tục.

Bài viết được AI dịch và tổng hợp tự động từ X: Rohan Paul (@rohanpaul_ai). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

EdgeBench: Các AI Agent mạnh nhất chỉ đạt 51,3 điểm sau 12 giờ thử thách | AIHOT.vn