Jiqizhixin
92

Mô hình

Khi sở hữu 10.000 hay 100.000 GPU: Làm thế nào để mở rộng quy mô huấn luyện RL?

(giờ Việt Nam)

Tóm tắt AI

Bài viết phân tích chiến lược tối ưu hóa Batch Size trong huấn luyện Reinforcement Learning (RL) quy mô lớn, giúp cân bằng giữa hiệu suất tính toán và thời gian huấn luyện để tiết kiệm chi phí vận hành hàng triệu USD.

Bản dịch AI

360.000 danh mục, 18 triệu hình ảnh, các tổ chức trong nước tạo ra tập dữ liệu khuôn mặt lớn nhất thế giới

Báo cáo từ Machine Heart, Ban biên tập Machine Heart: Nghiên cứu này dựa trên các tập dữ liệu khuôn mặt công khai hiện có... Khi huấn luyện dữ liệu ở quy mô như vậy, một phương pháp trực tiếp là song song hỗn hợp (hybrid parallelism), tức là...

Machine Heart

Huấn luyện 32 ngôn ngữ trong 7 ngày với 8 card, ByteDance ra mắt mô hình tiền huấn luyện đa ngôn ngữ mới mRASP

Công bố từ Machine Heart, Ban biên tập Machine Heart: ByteDance công bố tại hội nghị EMNLP 2020... Mặc dù các mô hình tiền huấn luyện đã xuất hiện nhiều thuật toán mới, nhưng hiệu quả đạt được vẫn còn những hạn chế nhất định...

Machine Heart

Tạm biệt "mất trí nhớ" và "đổi mặt"! SoulX-LiveAct: Chạy livestream AI trong vài giờ chỉ với 2 card, độ trễ giảm xuống dưới 1 giây!

Biên giới năng lực đã được mở rộng, nhưng các chỉ số phân phối trên EMTD cho thấy vẫn còn dư địa cải thiện đáng kể trong các cảnh quay toàn thân phức tạp. Mã nguồn huấn luyện vẫn chưa được công bố, khả năng tái lập của toàn bộ khung trên dữ liệu bên ngoài...

Một ly Cola trò chuyện về AI

Phần huấn luyện mô hình | ToolRL đa giai đoạn tạo ra trợ lý mua sắm AI đáng tin cậy hơn

Mở rộng phạm vi tìm kiếm (nếu không tìm thấy sản phẩm); 4. Nhận danh sách sản phẩm (danh sách sản phẩm=[...]... Khi kết hợp với cơ chế hiệu quả huấn luyện, những vấn đề này sẽ càng trầm trọng hơn. Hiệu quả huấn luyện thấp, việc lấy mẫu...

Alibaba Developer

Kiến thức nền tảng về Agentic RL (Học tăng cường tác tử): Khung huấn luyện Ray

Các thành phần này có khả năng mở rộng theo chiều ngang và có tính chịu lỗi nhất định. Dưới đây sẽ giới thiệu lần lượt... Dữ liệu chảy từ 200 card sang 800 card như thế nào? 3.1 Cách ly và lập lịch tài nguyên khi bắt đầu huấn luyện...

Ghi chú và thực hành thuật toán

Cụm tính toán (Compute Cluster) là gì? Đọc hiểu cách phân loại cụm tính toán và tại sao cần một đống máy chạy cùng nhau?

Cụm 100.000 card: Đúng như tên gọi, cụm 100.000 card được cấu thành từ hơn 100.000 card tính toán... 03. Tại sao cần một đống máy chạy cùng nhau? Lý do rất đơn giản, khối lượng dữ liệu huấn luyện cho các mô hình AI lớn...

Đội ngũ hành động chuyển đổi số

Lược sử siêu máy tính: Luyện kỹ năng bay, sau trận chiến đỉnh cao, cuối cùng cũng có ngày ứng dụng thực tế

Nhưng thực tế, hai cỗ máy được chế tạo đều chỉ có một CPU. Chưa đầy hai năm sau, trên toàn cầu... Một công ty có quy mô nhỏ hơn nhiều so với ông là CDC (Control Data Corporation), trong lần thứ hai...

Kỹ sư phái Hàng Châu

RL trong hậu huấn luyện (post-training) đã chết? Thuật toán mới của MIT thách thức tư duy hậu huấn luyện truyền thống, Xie Saining chia sẻ lại

Nguồn | Machine Heart: Trong quá trình phát triển LLM hiện nay, giai đoạn hậu huấn luyện thường được coi là... Scaling Law: Khi quy mô mô hình mở rộng, "cảnh quan" đại diện cho độ chính xác cao hơn...

Tiến hóa cơ khí 2 Trí tuệ nhân tạo

Khóa học AI bán được 50 triệu! "Tiến sĩ Thanh Hoa" Li Yizhou bị cáo buộc vi phạm bản quyền, tài khoản bị cấm, các khóa học bị gỡ bỏ trên toàn mạng; Kỳ lân huy động vốn hơn 1 tỷ nhân dân tệ bị đồn dừng hoạt động, công ty phản hồi | Tin tức AI hàng tuần

"Chúng tôi hiện vẫn chưa có con số cụ thể". Ông cũng nhấn mạnh việc tăng tốc trí tuệ nhân tạo trong năm qua... Nó sử dụng 100.000 giờ ghi âm (từ các trang web công cộng) để huấn luyện, trong đó phần lớn...

Cyzone (Chuangyebang)

Nhật ký thất nghiệp của một nhân viên cổ cồn vàng: Ngày thứ 1, lòng đẫm lệ; Ngày thứ 19, chuẩn bị đi cấy tóc…

Gặp đúng thời điểm thị trường chứng khoán mới (New Third Board) nổi lên, chỉ sau 3-5 năm làm việc đã đạt mức thu nhập hàng trăm ngàn mỗi năm... Nơi nào cũng có một đống tổ chức tham gia, điều này cho thấy nhân sự đã bão hòa. Trong thị trường quỹ trưởng thành, tinh...

Xueqiu

1 2 3 4 5 6 7 8 9 10 Trang sau

Tìm thấy khoảng 97 kết quả

Reinforcement LearningGPUTối ưu hóaHuấn luyện mô hìnhBatch Size
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Jiqizhixin. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.