Tin ngành
GenStorAIGE ra mắt giải pháp SSD AI90: Tăng tốc suy luận AI gấp 50 lần nhờ tối ưu hóa bộ nhớ
(giờ Việt Nam)
Tóm tắt AI
GenStorAIGE giới thiệu giải pháp AI90 kết hợp SSD vào hệ thống bộ nhớ GPU, giúp giảm độ trễ token đầu tiên xuống 50 lần và tăng thông lượng gấp 5,1 lần. Công nghệ này cho phép mở rộng bộ nhớ KV Cache lên SSD, hỗ trợ các cụm GPU xử lý ngữ cảnh lên tới 128K+.
Bản dịch AI
Theo tin từ IT ngày 20 tháng 7, tại sự kiện WAIC 2026, GenStorAIGE đã giới thiệu giải pháp tăng tốc suy luận AI tích hợp phần cứng và phần mềm AI90.

Giải pháp này đưa SSD hiệu năng cao vào hệ thống bộ nhớ GPU, cho phép chuyển tải (offload) KV Cache sang ổ cứng thể rắn có dung lượng lớn hơn, từ đó hình thành hệ thống lưu trữ ba tầng gồm HBM + DRAM + SSD.
Giải pháp này có thể giảm độ trễ của Token đầu tiên từ mức giây xuống mức dưới một giây, tăng tốc độ lên 50 lần; lưu lượng xử lý (throughput) tăng 5,1 lần; tiết kiệm 39% bộ nhớ GPU. Kết hợp với công nghệ kết nối đa card P2P thông minh, AI90 giúp cụm 8 card NVIDIA GeForce RTX 5090 tăng tốc suy luận lên tới 5,8 lần và hỗ trợ ngữ cảnh (context) trên 128K.

Để đáp ứng tải ghi dữ liệu cao phát sinh từ việc chuyển tải KV Cache, GenStorAIGE đồng thời ra mắt ổ cứng PT200Z AI SSD. Sản phẩm này dựa trên nền tảng bộ nhớ flash pSLC, sử dụng giao diện PCIe Gen5, với chỉ số DWPD lên tới 100, tốc độ đọc tuần tự đạt 14,8GB/s, đọc ngẫu nhiên đạt 3100K IOPS, độ trễ đọc là 54μs và độ trễ ghi là 10μs.
Chuyên đề Hội nghị Trí tuệ Nhân tạo Thế giới 2026
Tuyên bố quảng cáo: Các liên kết chuyển hướng bên ngoài trong bài viết (bao gồm nhưng không giới hạn ở siêu liên kết, mã QR, mật khẩu, v.v.) được sử dụng để truyền tải thêm thông tin, giúp tiết kiệm thời gian chọn lọc, kết quả chỉ mang tính chất tham khảo. Tất cả các bài viết trên IT đều bao gồm tuyên bố này.
Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.