# Tại sao các AI tự động nghiên cứu khoa học lại thất bại? Đánh giá toàn diện trên 100 tác vụ thực tế

- Nguồn: Hugging Face Daily Papers
- Thời gian phát hành: 2026-08-18 07:00 (giờ Việt Nam)
- Điểm AI: 92/100
- Nhãn AIHOT: Tinh chọn
- Link AIHOT.vn: https://aihot.vn/items/8cda7f79ae53f7df
- Link gốc: https://arxiv.org/abs/2608.14905

## Lý do tinh chọn

Nghiên cứu thực nghiệm quan trọng, giải quyết lỗ hổng trong việc đánh giá khả năng thực thi của AI agent trong các tác vụ khoa học phức tạp và thực tế.

## Tóm tắt AI

Nghiên cứu giới thiệu AutoResearchEval, bộ dữ liệu gồm 100 tác vụ khoa học thực tế để phân tích quy trình và các điểm yếu của AI trong toàn bộ vòng đời nghiên cứu, từ lên ý tưởng đến viết báo cáo.

## Thân bài

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

### Lịch sử gửi bài

Từ: Qingqing Mao [xem email] [v1] Thứ Sáu, 14 tháng 8 năm 2026 21:39:38 UTC (9.768 KB)
