IT Home ITHome
85

Tin ngành

Nhu cầu từ nền tảng Vera Rubin của NVIDIA đẩy giá chip nhớ TLC NAND tăng trở lại

(giờ Việt Nam)

Tóm tắt AI

Việc NVIDIA đẩy mạnh sản xuất nền tảng Vera Rubin với công nghệ CMX sử dụng lượng lớn bộ nhớ flash đã làm thắt chặt nguồn cung, khiến giá chip TLC NAND 512Gb quay đầu tăng lên mức 21 USD.

Bản dịch AI

Theo tin từ IT ngày 16 tháng 8, quy mô mở rộng sản xuất hàng loạt nền tảng Vera Rubin của NVIDIA hiện đã lan rộng đến những ngóc ngách ít ai ngờ tới trong chuỗi cung ứng, chẳng hạn như thị trường giao ngay (spot market) của TLC NAND.

Tuy nhiên, nhìn lại thì việc giá giao ngay của TLC tăng là hoàn toàn hợp lý, đặc biệt là sau khi NVIDIA tích hợp công nghệ Mở rộng bộ nhớ ngữ cảnh (Context Memory eXtension - CMX) cho nền tảng Vera Rubin. Khi tốc độ sản xuất hàng loạt nền tảng Vera Rubin tăng lên, số lượng chip NAND bị CMX chiếm dụng liên tục tăng, cộng với nhu cầu về ổ cứng thể rắn (SSD) cấp doanh nghiệp cũng tăng theo, khiến nguồn cung TLC NAND ngày càng thắt chặt.

Sau khi giá giao ngay của 512Gb TLC NAND giảm xuống dưới 21 USD vào tháng 6 (IT lưu ý: tỷ giá hối đoái hiện tại tương đương khoảng 141,9 nhân dân tệ), giá hiện đã quay trở lại mức này. Đợt tăng giá này được thúc đẩy bởi nhiều yếu tố cộng hưởng.

Đầu tiên, để xử lý bộ nhớ đệm khóa-giá trị (KV cache) — tức dữ liệu bộ nhớ đệm được tạo ra khi các lớp chú ý (attention layers) của mô hình AI thiết lập mối liên kết ngữ nghĩa giữa các từ trong câu lệnh đầu vào (input prompt), NVIDIA đã đưa công nghệ CMX vào nền tảng Vera Rubin.

CMX xây dựng một kiến trúc lưu trữ trung gian giữa bộ nhớ băng thông cao (HBM) và lưu trữ mạng truyền thống, về bản chất là một kho tài nguyên lưu trữ flash TLC dung lượng cực lớn. Kho tài nguyên này kết nối với cụm GPU Rubin thông qua mạng Ethernet Spectrum-X siêu tốc và được quản lý bởi DPU BlueField-4 của NVIDIA: mẫu DPU này đóng vai trò như "bộ não thông minh" của máy chủ CMX, có khả năng xử lý KV cache theo thời gian thực.

Trên thực tế, một máy chủ CMX chuẩn 2U có thể chứa tới 600TB bộ nhớ flash TLC, với 4 DPU tích hợp, mỗi DPU quản lý 150TB bộ nhớ ngữ cảnh; trong khi tổng dung lượng của một cụm tủ rack (pod) có thể đạt tới 9600TB, tức 9,6PB.

Thứ hai, các trung tâm dữ liệu cần ổ cứng thể rắn cấp doanh nghiệp (eSSD) có mật độ cao và hiệu suất cao để gánh vác các khối lượng công việc AI. Khi quá trình sản xuất hàng loạt nền tảng Vera Rubin được đẩy mạnh, nhu cầu về loại SSD doanh nghiệp này cũng tăng theo tương ứng.

Tất nhiên cần lưu ý rằng, phần lớn lượng TLC NAND mà NVIDIA tiêu thụ hiện nay đã được chốt nguồn cung thông qua các hợp đồng dài hạn. Dù vậy, sự gia tăng đột biến về quy mô nhu cầu vẫn khiến nguồn cung trên thị trường giao ngay bị thắt chặt, và xu hướng tăng giá này sẽ kéo dài bao lâu vẫn còn là một ẩn số.

Trong khi đó, Bank of America gần đây đã bác bỏ tin đồn cho rằng "phiên bản Vera Rubin Ultra sẽ bị cắt giảm HBM". Trước đó, thị trường từng rộ lên tin đồn rằng NVIDIA có thể giảm dung lượng HBM4E trên mỗi GPU để đảm bảo biên lợi nhuận. Tuy nhiên, Bank of America cho rằng, ngay cả khi có việc cắt giảm, đó cũng chỉ là biện pháp tạm thời để đối phó với những hạn chế về nguồn cung trong ngắn hạn, chứ không phải là tung ra các dòng sản phẩm có dung lượng thấp vĩnh viễn.

NVIDIAVera RubinTLC NANDPhần cứng AIChuỗi cung ứng
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.