# MetroLLM-Bench: Đánh giá mô hình ngôn ngữ trong vai trò trợ lý điều hành hệ thống tàu điện ngầm

- Nguồn: Hugging Face Daily Papers
- Thời gian phát hành: 2026-09-11 07:00 (giờ Việt Nam)
- Điểm AI: 85/100
- Link AIHOT.vn: https://aihot.vn/items/d77021c9a1f367bd
- Link gốc: https://arxiv.org/abs/2609.10016

## Tóm tắt AI

MetroLLM-Bench là bộ tiêu chuẩn mới gồm 955 tình huống thực tế, giúp đánh giá khả năng của AI trong việc xử lý lộ trình, giá vé và sự cố tại các ki-ốt tàu điện ngầm thông qua việc sử dụng công cụ có cấu trúc.

## Thân bài

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

### Lịch sử gửi bài

Từ: Remco Hendriks [xem email] [v1] Thứ Tư, 9 tháng 9, 2026 10:46:56 UTC (1.303 KB)
