Sản phẩm
OpenBMB ra mắt Ultra-FineWeb-L1: Bộ dữ liệu huấn luyện AI chất lượng cao với 1 nghìn tỷ token
(giờ Việt Nam)
Nguyên văn trên X
🔥 Ultra-FineWeb-L1 is here -- 1T+ tokens of high-quality web data are now available! High-quality …
Dịch · tóm tắt AI
OpenBMB vừa công bố Ultra-FineWeb-L1, bộ dữ liệu tiếng Anh tinh lọc với hơn 1 nghìn tỷ token, được tối ưu hóa qua quy trình lọc và khử trùng lặp nghiêm ngặt nhằm nâng cao hiệu suất cho các mô hình ngôn ngữ lớn.

Bài viết được AI dịch và tổng hợp tự động từ X: ModelBest OpenBMB (@OpenBMB). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.