Rohan Paul@rohanpaul_ai
Điểm AI 68/100

Nghiên cứu

Nghiên cứu của Microsoft: Hiệu suất của LLM Agent giảm mạnh khi thực hiện các tác vụ dài

(giờ Việt Nam)

Nguyên văn trên X

New Microsoft paper. Long agent runs expose failures that short benchmarks miss. Agents can look rel…

Dịch · tóm tắt AI

Nghiên cứu mới từ Microsoft chỉ ra rằng các LLM Agent mất khả năng xử lý khi số bước thực hiện tăng lên, với tỷ lệ thành công giảm từ gần 100% xuống còn 0-33% ở bước thứ 16. Vấn đề nằm ở số lượng bước thay vì độ dài ngữ cảnh, đòi hỏi các giải pháp kiểm soát lỗi theo từng giai đoạn.

Bài viết được AI dịch và tổng hợp tự động từ X: Rohan Paul (@rohanpaul_ai). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Nghiên cứu của Microsoft: Hiệu suất của LLM Agent giảm mạnh khi thực hiện các tác vụ dài | AIHOT.vn