Supermicro bắt đầu cung cấp hệ thống NVIDIA Vera Rubin NVL72 với giải pháp làm mát bằng chất lỏng toàn diện, hỗ trợ quy mô lên đến 5MW và tích hợp 1.152 GPU Rubin cùng 331TB bộ nhớ HBM4.
Hệ thống Vera Rubin NVL72 lần đầu xuất hiện tại MLPerf Inference v6.1, đạt tốc độ xử lý nhanh gấp 3.7 lần so với GB300 NVL72 trên mô hình Qwen3-VL và 2.5 lần trên DeepSeek-R1.
Tại hội nghị AI Infra Summit, NVIDIA giới thiệu nền tảng DSX MaxLPS giúp tăng 40% công suất GPU và 35% lưu lượng token trên cùng một mức tiêu thụ điện năng, tối ưu hóa hiệu quả cho các trung tâm dữ liệu AI.
NVIDIA Groq 3 LPX sử dụng mô hình thực thi xác định để tối ưu hóa lịch trình vận hành trên 256 chip LPU, kết hợp công nghệ PEP và CPS giúp giảm lãng phí điện năng, từ đó tăng cường hiệu suất suy luận cho kiến trúc Vera Rubin.
Vera Rubin NVL72 Agentic Inference: 67x better Performance per Dollar Jensen Sandbagging Performanc…
DịchHệ thống Vera Rubin NVL72 mang lại hiệu suất suy luận Agent vượt trội với mức tăng 67 lần trên mỗi USD, giúp tối ưu hóa lợi nhuận trên mỗi gigawatt và khẳng định chiến lược thiết kế đồng bộ hóa cực hạn của NVIDIA.
Dựa trên bài kiểm tra AgentX, hệ thống Vera Rubin NVL72 cho thấy hiệu suất suy luận vượt trội, đạt mức tối ưu gấp 67 lần so với GB300 Dynamo trong các tác vụ đòi hỏi thông lượng cao.
an absolute spectacle. nvidia Vera Rubin NVL72 racks
DịchDell đã chính thức cung cấp những hệ thống máy chủ NVIDIA Vera Rubin NVL72 thương mại đầu tiên cho CoreWeave, đánh dấu bước tiến quan trọng trong hạ tầng tính toán AI hiệu năng cao.
NVIDIA công bố kiến trúc Vera Rubin với khả năng tối ưu hóa vượt trội cho AI Agent, giúp tăng gấp 30 lần lưu lượng xử lý và giảm 35 lần chi phí token so với thế hệ trước, đồng thời được SpaceX lựa chọn để mở rộng hạ tầng tính toán.
Vì sao đáng đọc: Tin tức công nghệ quan trọng về phần cứng AI thế hệ mới, tác động trực tiếp đến hiệu suất vận hành Agent và chi phí triển khai, có tính thời sự cao và thu hút giới chuyên môn.
Thử nghiệm với mô hình DeepSeek-V4-PRO cho thấy hệ thống Vera Rubin NVL72 đạt hiệu suất năng lượng gấp 30 lần so với GB300, đồng thời giảm chi phí vận hành trên mỗi triệu token xuống chỉ còn 1/35.
SpaceX ❤️ NVIDIA SpaceX and NVIDIA designed a space-optimized Vera Rubin NVL72 system for an orbita…
DịchSpaceX và NVIDIA cùng phát triển hệ thống Vera Rubin NVL72 tối ưu cho không gian, dự kiến phóng vào cuối năm nay để tăng cường sức mạnh tính toán cho AI Grok và các vệ tinh Starmind thế hệ mới.
NVIDIA mở rộng khả năng tạo token tốc độ cao trên nền tảng Vera Rubin NVL72 để tối ưu cho các hệ thống AI Agent. Đồng thời, hệ thống Groq 3 LPX đã được đưa vào sản xuất hàng loạt, tập trung vào sự phối hợp toàn diện giữa hạ tầng thay vì chỉ dựa vào sức mạnh đơn lẻ của chip.
Dữ liệu từ NVIDIA cho thấy Vera Rubin NVL72 giúp tăng lưu lượng xử lý trên mỗi megawatt lên gấp 30 lần và giảm chi phí trên mỗi triệu token xuống 35 lần so với thế hệ GB300 NVL72.
Vì sao đáng đọc: Tin tức quan trọng về phần cứng thế hệ mới của NVIDIA, tác động trực tiếp đến chi phí vận hành và hiệu suất của các hệ thống AI Agent quy mô lớn.
These scenes are so quietly beautiful. Microsoft's Azure infrastructure has received its first prod…
DịchMicrosoft Azure đã chính thức tiếp nhận những hệ thống NVIDIA Vera Rubin đầu tiên phục vụ sản xuất, đánh dấu bước tiến mới trong hạ tầng điện toán AI hiệu năng cao.
Delivery day at our Microsoft DCs as the first production Vera Rubins arrive. A huge thank you to ou…
DịchMicrosoft đã nhận lô chip Vera Rubin đầu tiên từ NVIDIA để triển khai tại các trung tâm dữ liệu Azure, đánh dấu cột mốc quan trọng trong việc nâng cấp hạ tầng AI.
DịchOpenAI và NVIDIA vừa đạt cột mốc quan trọng khi chính thức đưa các cụm máy chủ Vera Rubin vào hoạt động, đánh dấu bước tiến mới trong hạ tầng tính toán cho AI.
Việc NVIDIA đẩy mạnh sản xuất nền tảng Vera Rubin với công nghệ CMX sử dụng lượng lớn bộ nhớ flash đã làm thắt chặt nguồn cung, khiến giá chip TLC NAND 512Gb quay đầu tăng lên mức 21 USD.