Tin ngành
AMD bắt tay Cerebras tối ưu hóa AI suy luận: Tăng hiệu suất 5 lần trên mỗi Watt
(giờ Việt Nam)
Tóm tắt AI
AMD hợp tác cùng Cerebras phát triển giải pháp AI suy luận độ trễ thấp, kết hợp hệ thống Helios và chip Wafer-Scale để tăng gấp 5 lần hiệu suất Token/Watt, cạnh tranh trực tiếp với Nvidia và Groq.
Bản dịch AI
Theo tin từ IT ngày 24 tháng 7, trang tin công nghệ Wccftech hôm nay (24/7) đã đăng tải bài viết cho biết tại sự kiện Advancing AI 2026, AMD thông báo sẽ hợp tác cùng Cerebras để cùng phát triển các giải pháp suy luận AI.

Theo thông cáo báo chí chính thức, giải pháp này chủ yếu nhắm vào các kịch bản suy luận AI có độ trễ cực thấp, bằng cách tích hợp giải pháp cấp rack Helios của AMD với Wafer-Scale Engine của Cerebras, nhằm đối trọng với sự hợp tác giữa NVIDIA và Groq.

Theo lộ trình được hai bên tiết lộ, rack Helios đóng vai trò là công cụ xử lý thông lượng hiệu năng cao và có khả năng mở rộng, chủ yếu xử lý các câu lệnh (prompt) và cửa sổ ngữ cảnh lớn.
Trong khi đó, Wafer-Scale Engine của Cerebras đảm nhận khâu tạo và giải mã token vốn đòi hỏi băng thông bộ nhớ cao hơn, nhấn mạnh vào hiệu suất độ trễ cực thấp. Việc kết hợp sử dụng 2 công cụ tính toán này được dự đoán sẽ giúp tăng số lượng token trên mỗi watt mỗi giây lên gấp 5 lần. IT đính kèm ảnh chụp màn hình liên quan dưới đây:


Cerebras cho biết, Wafer-Scale Engine kết nối liền mạch hàng trăm nghìn nhân tính toán và hàng chục GB SRAM trên một tấm silicon đơn lẻ, giúp giảm thiểu ảnh hưởng của các nút thắt mạng bên ngoài đối với việc truyền tải dữ liệu.
Thông báo quảng cáo: Các liên kết chuyển hướng bên ngoài trong bài viết (bao gồm nhưng không giới hạn ở siêu liên kết, mã QR, mật khẩu, v.v.) được sử dụng để truyền tải thêm thông tin, tiết kiệm thời gian chọn lọc, kết quả chỉ mang tính chất tham khảo, tất cả các bài viết của IT đều bao gồm thông báo này.
Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.