OpenBMB@OpenBMB
85

Sản phẩm

OpenBMB ra mắt Ultra-FineWeb-L1: Bộ dữ liệu huấn luyện AI chất lượng cao với 1 nghìn tỷ token

(giờ Việt Nam)

Tóm tắt AI

OpenBMB vừa công bố Ultra-FineWeb-L1, bộ dữ liệu tiếng Anh tinh lọc với hơn 1 nghìn tỷ token, được tối ưu hóa qua quy trình lọc và khử trùng lặp nghiêm ngặt nhằm nâng cao hiệu suất cho các mô hình ngôn ngữ lớn.

OpenBMBDữ liệu AILLMHuggingFaceDữ liệu huấn luyện
Xem nguyên văn trên X

Bài viết được AI dịch và tổng hợp tự động từ X: OpenBMB (@OpenBMB). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.