# Dữ liệu tổng hợp có thể đưa OCR tiếng Thái đi xa đến đâu?

- Nguồn: Hugging Face Daily Papers
- Thời gian phát hành: 2026-09-14 07:00 (giờ Việt Nam)
- Điểm AI: 85/100
- Link AIHOT.vn: https://aihot.vn/items/1b1f8fa13ec8f79e
- Link gốc: https://arxiv.org/abs/2609.03595

## Tóm tắt AI

Nghiên cứu khám phá cách tối ưu hóa dữ liệu tổng hợp để huấn luyện mô hình OCR tiếng Thái mà không cần nhãn thực tế, từ đó tạo ra Wayu-Paxa-OCR-Zero với độ chính xác tiệm cận dữ liệu thực.

## Thân bài

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

### Lịch sử gửi bài

Từ: Kunat Pipatanakul [xem email] [v1] Thứ Năm, ngày 3 tháng 9 năm 2026 09:46:19 UTC (4.218 KB)
