26/09

Thứ Bảy · 4 tin
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 59/100

Báo cáo Columbia Business School: Cần 3,7 nghìn tỷ USD doanh thu để vận hành 182,7 GW trung tâm dữ liệu AI

The $800B-$1T AI capex wave is a beautiful choreography of chips, power, credit, and capital. Hyper…

DịchBáo cáo phân tích lộ trình xây dựng hạ tầng AI tại Mỹ giai đoạn 2025-2032, ước tính cần 77 triệu GPU và doanh thu 5,5 USD/giờ cho mỗi GPU để bù đắp chi phí đầu tư khổng lồ.

SemiAnalysis@SemiAnalysis_
NgànhĐiểm AI 49/100

Nebius đạt chuẩn ClusterMAX Platinum, thách thức vị thế của CoreWeave

Nebius made ClusterMAX Platinum, and in testing it is getting hard to tell apart from CoreWeave. It …

DịchNebius vừa đạt chứng nhận ClusterMAX Platinum với hiệu năng tiệm cận CoreWeave. Trong bối cảnh CoreWeave quá tải đơn hàng đến tận tháng 5/2027, Nebius đang tận dụng cơ hội để chiếm lĩnh thị phần hạ tầng GPU quan trọng.

25/09

Thứ Sáu · 4 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 57/100

Elon Musk dự kiến bổ sung 660.000 GPU GB300 cho siêu máy tính Colossus 2 vào cuối năm

Elon Musk is planing for new set of 660k GB 300 GPUs by the end of this year for Colossus 2.

DịchElon Musk tiết lộ lộ trình nâng cấp Colossus 2 với việc bổ sung liên tục các cụm GPU GB300, dự kiến đạt tổng cộng 660.000 đơn vị vào cuối tháng 12 để tăng cường sức mạnh tính toán.

Thêm 1 nguồn khác đưa tinIT Home
SemiAnalysis@SemiAnalysis_
NgànhĐiểm AI 47/100

SemiAnalysis dùng công cụ mã nguồn mở cmax để kiểm thử áp lực lên các cụm GPU

Agentic coding puts a kind of stress on GPU clusters that providers are struggling to handle. SemiAn…

DịchSemiAnalysis sử dụng công cụ CLI cmax để kiểm thử khả năng chịu tải của các cụm GPU với khối lượng công việc từ lập trình tác tử (agentic coding), vốn gây áp lực khác biệt và khó xử lý hơn so với các tác vụ thông thường.

24/09

Thứ Năm · 6 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Sản phẩmĐiểm AI 52/100

Virtio-nvgpu: Giải pháp mã nguồn mở giúp máy ảo KVM đạt hiệu năng GPU NVIDIA gần như máy thật

Dự án virtio-nvgpu vừa ra mắt, cho phép máy ảo KVM truy cập GPU NVIDIA với hiệu năng đạt 98-100% so với máy vật lý nhờ cơ chế chuyển tiếp ioctl trực tiếp, giúp tối ưu hóa đáng kể cho các tác vụ AI và đồ họa trên môi trường ảo hóa.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 57/100

DeepSeek thử nghiệm dùng GPU chơi game để chạy suy luận mô hình nhỏ nhằm giảm tải hạ tầng

DeepSeek is testing whether aggressive model optimization can push some share of inference for its s…

DịchDeepSeek đang thử nghiệm tối ưu hóa mô hình để có thể chạy suy luận trên các dòng GPU chơi game phổ thông, giúp giảm bớt áp lực thiếu hụt tài nguyên tính toán cao cấp.

Jason Liu@jxnlco
Quan điểmĐiểm AI 30/100

Phải chăng phần cứng không đồng nhất là nguyên nhân khiến các mô hình AI 'trở nên ngốc nghếch'?

Whereas I mostly blame feature flags

DịchGiả thuyết cho rằng cảm giác mô hình bị 'giảm sức mạnh' thực chất đến từ việc sử dụng các loại phần cứng khác nhau (GPU, TPU, Inferentia) để xử lý tải trọng cao, dẫn đến chất lượng đầu ra không đồng nhất.

23/09

Thứ Tư · 4 tin

22/09

Thứ Ba · 3 tin
JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnKhi sở hữu 10.000 hay 100.000 GPU: Làm thế nào để mở rộng quy mô huấn luyện RL?

Bài viết phân tích chiến lược tối ưu hóa Batch Size trong huấn luyện Reinforcement Learning (RL) quy mô lớn, giúp cân bằng giữa hiệu suất tính toán và thời gian huấn luyện để tiết kiệm chi phí vận hành hàng triệu USD.


Vì sao đáng đọc: Chủ đề cực kỳ thực tế cho các kỹ sư AI và doanh nghiệp đang chạy mô hình lớn, phân tích sâu về bài toán tối ưu hóa chi phí và hiệu suất phần cứng.

21/09

Thứ Hai · 6 tin
SemiAnalysis@SemiAnalysis_
NgànhĐiểm AI 37/100

Công nghệ Engram trên DRAM giúp tăng 50% hiệu năng cho dòng chip H200, B200, B300 và GB300

Experiments have shown that offloading Engram to DRAM results in up to 50% better performance on H20…

DịchViệc chuyển tải dữ liệu Engram sang DRAM mang lại bước tiến lớn về tốc độ xử lý, giúp tối ưu hóa hiệu suất cho các dòng GPU thế hệ mới của NVIDIA như H200, B200 và GB300.

@mark_k@mark_k
NgànhĐiểm AI 28/100

GPU chơi game thế hệ mới của Nvidia có thể bị trì hoãn đến năm 2028

The next @nvidia gaming GPU may be delayed until 2028! This graphics card would be based on the Rub…

DịchDòng card đồ họa chơi game tiếp theo của Nvidia dự kiến sẽ sử dụng kiến trúc Rubin, vốn đang được ưu tiên cho các tác vụ AI cao cấp, khiến thời điểm ra mắt có thể bị lùi sang năm 2028.

Yuchen Jin@Yuchenj_UW
NgànhĐiểm AI 34/100

Các phòng thí nghiệm AI Trung Quốc bác bỏ tin đồn 'khai tử' mã nguồn mở

This is not true from what I'm hearing from the Chinese AI labs. They plan to keep open-sourcing mo…

DịchTrái với những đồn đoán về việc đóng cửa mã nguồn, các phòng thí nghiệm AI tại Trung Quốc khẳng định sẽ tiếp tục duy trì mô hình mở. Họ coi việc chia sẻ doanh thu từ dịch vụ suy luận là chiến lược kinh doanh bền vững và là kênh phân phối hiệu quả trong bối cảnh khan hiếm GPU.

20/09

Chủ Nhật · 2 tin

19/09

Thứ Bảy · 2 tin

18/09

Thứ Sáu · 3 tin

17/09

Thứ Năm · 5 tin
IT Home
NgànhĐiểm AI 85/100

Valve ưu tiên phát triển driver NVIDIA cho SteamOS, bước tiến mới cho game thủ Linux

Valve xác nhận việc hỗ trợ driver NVIDIA trên SteamOS là ưu tiên hàng đầu. Hiện tại, một số dòng GPU NVIDIA đã có thể khởi chạy và hiển thị hình ảnh trên hệ điều hành này, dù đội ngũ vẫn đang nỗ lực tối ưu hóa hiệu năng để bắt kịp các tiêu chuẩn hiện đại.

16/09

Thứ Tư · 5 tin
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (68 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “GPU” | AIHOT.vn