25/08

Thứ Ba · 32 tin
Kim@kimmonismus
Hướng dẫnĐiểm AI 28/100

Dự đoán OpenAI DevDay 2026: Ra mắt GPT Astra và thiết bị phần cứng đầu tiên

Super excited for OpenAI's DevDay. My guess as to why Tibo says it's so important: - I don't think …

DịchCác dự đoán mới nhất cho thấy OpenAI DevDay 2026 sẽ trình làng mô hình GPT Astra, dòng phần cứng tự phát triển và các AI nghiên cứu viên thế hệ mới với khả năng tùy biến cao.

JiQiZhiXin
Sản phẩmĐiểm AI 92/100

Tinh chọnNVIDIA Vera Rubin ra mắt: DeepSeek V4 Pro đạt hiệu suất xử lý Agent gấp 30 lần

NVIDIA công bố kiến trúc Vera Rubin với khả năng tối ưu hóa vượt trội cho AI Agent, giúp tăng gấp 30 lần lưu lượng xử lý và giảm 35 lần chi phí token so với thế hệ trước, đồng thời được SpaceX lựa chọn để mở rộng hạ tầng tính toán.


Vì sao đáng đọc: Tin tức công nghệ quan trọng về phần cứng AI thế hệ mới, tác động trực tiếp đến hiệu suất vận hành Agent và chi phí triển khai, có tính thời sự cao và thu hút giới chuyên môn.
Kim@kimmonismus
Sản phẩmĐiểm AI 20/100

Apple sắp ra mắt Mac mini mới: Cấu hình mạnh mẽ cho tác vụ AI

Nice: Apple may launch an M5 or M6 Mac mini before its iPhone keynote, "as soon as the coming days" …

DịchApple dự kiến trình làng Mac mini thế hệ mới trong vài ngày tới sau gần 2 năm chờ đợi. Thiết bị được kỳ vọng sẽ đáp ứng nhu cầu chạy các ứng dụng AI cục bộ đang tăng cao, vốn đang gây ra tình trạng khan hiếm nguồn cung cho các phiên bản hiện tại.

IT Home
Hướng dẫnĐiểm AI 50/100

Cùng sự kiệnDeepSeek-V4-PRO trên nền tảng Nvidia Vera Rubin: Hiệu suất năng lượng gấp 30 lần GB300

Thử nghiệm với mô hình DeepSeek-V4-PRO cho thấy hệ thống Vera Rubin NVL72 đạt hiệu suất năng lượng gấp 30 lần so với GB300, đồng thời giảm chi phí vận hành trên mỗi triệu token xuống chỉ còn 1/35.

Cùng sự kiện, bài đại diện «OpenAI ra mắt chip suy luận tự phát triển Jalapeño: Đột phá về tốc độ và hiệu suất năng lượng»
SemiAnalysis@SemiAnalysis_
Sản phẩmĐiểm AI 60/100

Dung lượng HBM4 trên Nvidia Rubin Ultra giảm mạnh xuống còn 192GB

HBM MASSIVE CONTENT DOWNGRADE ALERT🚨🚨: Nvidia Rubin Ultra will ship with 192GB of HBM4 8-hi. Not o…

DịchNvidia Rubin Ultra sẽ sử dụng 192GB HBM4 8-hi thay vì 1TB như dự kiến ban đầu. Sự sụt giảm này do thay đổi cấu trúc xếp chồng và sử dụng chip nhớ 24Gb, thấp hơn cả mức 288GB trên dòng Rubin tiêu chuẩn.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 35/100

NVIDIA áp đảo AMD về hiệu quả chi phí: Dùng chip NVIDIA vẫn rẻ hơn dù chip AMD được cho không

NVIDIA reaches up to 5x better cost efficiency than AMD at 150 tok/s/user on its GLM 5.3 SGLang comp…

DịchBáo cáo từ SemiAnalysis cho thấy tại mức 150 tok/s/user, hiệu quả chi phí của NVIDIA vượt trội gấp 5 lần AMD. Thậm chí nếu chip AMD miễn phí, tổng chi phí vận hành của NVIDIA vẫn thấp hơn nhờ tối ưu hóa phần mềm vượt trội.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 49/100

NVIDIA tích hợp công nghệ Groq vào hệ thống máy chủ rack-scale

8 months after NVIDIA's non-exclusive Groq licensing arrangement, Groq technology finally is appeari…

DịchNVIDIA chính thức đưa công nghệ Groq vào các hệ thống rack-scale mới, kết hợp GPU Rubin cho tính toán nặng và Groq 3 LPX để tối ưu tốc độ phản hồi, hứa hẹn hiệu suất nhanh gấp 4 lần so với Cerebras.

24/08

Thứ Hai · 23 tin
Kim@kimmonismus
Sản phẩmĐiểm AI 48/100

NVIDIA Groq 3 LPX chính thức sản xuất: Thiết lập kỷ lục tốc độ tạo token mới

Inference on steroid: NVIDIA's Groq 3 LPX is now in full production, adding a dedicated token-genera…

DịchNVIDIA Groq 3 LPX đã đi vào sản xuất hàng loạt, đạt tốc độ kỷ lục 3400 token/giây khi chạy mô hình Gemma 4 31B. Công nghệ này sẽ sớm được triển khai trên nền tảng Vera Rubin thông qua Nebius và Groq.

Thêm 1 nguồn khác đưa tinX: Artificial Analysis (@ArtificialAnlys)
NVIDIA Blog
Sản phẩmĐiểm AI 45/100

NVIDIA nâng cấp Vera Rubin cho hệ thống AI Agent, Groq 3 LPX chính thức đi vào sản xuất

NVIDIA mở rộng khả năng tạo token tốc độ cao trên nền tảng Vera Rubin NVL72 để tối ưu cho các hệ thống AI Agent. Đồng thời, hệ thống Groq 3 LPX đã được đưa vào sản xuất hàng loạt, tập trung vào sự phối hợp toàn diện giữa hạ tầng thay vì chỉ dựa vào sức mạnh đơn lẻ của chip.

Thêm 1 nguồn khác đưa tinIT Home
NVIDIA Blog
Sản phẩmĐiểm AI 63/100

Tinh chọnNVIDIA Vera Rubin NVL72 thiết lập chuẩn mực mới: Hiệu suất xử lý AI Agent tăng gấp 30 lần

Dữ liệu từ NVIDIA cho thấy Vera Rubin NVL72 giúp tăng lưu lượng xử lý trên mỗi megawatt lên gấp 30 lần và giảm chi phí trên mỗi triệu token xuống 35 lần so với thế hệ GB300 NVL72.

Thêm 1 nguồn khác đưa tinJiqizhixin

Vì sao đáng đọc: Tin tức quan trọng về phần cứng thế hệ mới của NVIDIA, tác động trực tiếp đến chi phí vận hành và hiệu suất của các hệ thống AI Agent quy mô lớn.
The Decoder: AI News
Sản phẩmĐiểm AI 46/100

Cùng sự kiệnCerebras ra mắt siêu chip AI CS-4: Hiệu năng gấp đôi, tốc độ xử lý vượt xa Nvidia

Cerebras vừa trình làng hệ thống AI CS-4 với chip WSE-3 cải tiến, cho phép tăng gấp đôi xung nhịp và đạt tốc độ xử lý 4.400 tokens/giây, được tuyên bố nhanh gấp 30 lần so với các giải pháp GPU từ Nvidia.

Cùng sự kiện, bài đại diện «OpenAI ra mắt chip suy luận tự phát triển Jalapeño: Đột phá về tốc độ và hiệu suất năng lượng»
Yuchen Jin@Yuchenj_UW
Hướng dẫnĐiểm AI 36/100

Tốc độ chạy mô hình AI cục bộ trên PC gaming tăng gấp 12 lần sau 3 năm

2024: A gaming PC with a RTX 4090 ran Llama 3 70B at ~2 tok/s in 4-bit. 2026: A gaming PC with a RT…

DịchTừ mức 2 tok/s trên RTX 4090 năm 2024, tốc độ chạy mô hình AI cục bộ dự kiến đạt 24 tok/s trên RTX 5090 vào năm 2026, mở ra khả năng chạy các mô hình thông minh cấp độ cao ngay tại nhà.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 26/100

Robot Booster K1: Nhỏ gọn, linh hoạt và an toàn hơn khi di chuyển

they look completely at home on that track. at under 20 kg and suitcase-friendly height, these Boos…

DịchVới trọng lượng dưới 20kg và kích thước tương đương vali xách tay, robot Booster K1 không chỉ cực kỳ di động mà còn đảm bảo an toàn tối đa khi vận hành trong môi trường đông người.

23/08

Chủ Nhật · 7 tin
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (35 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “phần cứng AI” — Trang 10 | AIHOT.vn