25/08

Thứ Ba · 30 tin
IT Home
Hướng dẫnĐiểm AI 50/100

Cùng sự kiệnDeepSeek-V4-PRO trên nền tảng Nvidia Vera Rubin: Hiệu suất năng lượng gấp 30 lần GB300

Thử nghiệm với mô hình DeepSeek-V4-PRO cho thấy hệ thống Vera Rubin NVL72 đạt hiệu suất năng lượng gấp 30 lần so với GB300, đồng thời giảm chi phí vận hành trên mỗi triệu token xuống chỉ còn 1/35.

Cùng sự kiện, bài đại diện «OpenAI ra mắt chip suy luận tự phát triển Jalapeño: Đột phá về tốc độ và hiệu suất năng lượng»
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 49/100

NVIDIA Groq 3 LPX thiết lập kỷ lục tốc độ suy luận cho Gemma 4 31B

Artificial Analysis has measured 3, 431 tokens/s on Gemma 4 31B via a private demonstration endpoint …

DịchArtificial Analysis ghi nhận NVIDIA Groq 3 LPX đạt tốc độ suy luận ấn tượng 3.431 tokens/giây cho mô hình Gemma 4 31B, duy trì hiệu suất ổn định ngay cả với ngữ cảnh 100k.

smol.ai AI News
NgànhĐiểm AI 85/100

Điểm tin AI: Bước tiến mới trong đánh giá tác nhân và làn sóng mô hình mã nguồn mở

Nghiên cứu mới từ NVIDIA giới thiệu chỉ số 'Skill Lift' để đánh giá tác nhân AI, trong khi các dự án như Headlong và MCP của Anthropic đang định hình lại hạ tầng vận hành bền bỉ. Đồng thời, thị trường đón nhận các mô hình mã nguồn mở mạnh mẽ cùng nhiều tin đồn về các siêu AI sắp ra mắt.

MiniMax@MiniMax_AI
Sản phẩmĐiểm AI 38/100

MiniMax H3 đạt tốc độ suy luận nhanh gấp 27,7 lần trên chip NVIDIA GB200

The real breakthrough in the NVIDIA SANA team's Sol Engine work on MiniMax H3! By splitting generat…

DịchNhờ công cụ Sol Engine từ đội ngũ NVIDIA SANA, thời gian tạo video 10 giây (768p) của MiniMax H3 đã giảm từ 414 giây xuống còn 14,93 giây, đánh dấu bước tiến vượt bậc về hiệu suất xử lý.

SemiAnalysis@SemiAnalysis_
Sản phẩmĐiểm AI 60/100

Dung lượng HBM4 trên Nvidia Rubin Ultra giảm mạnh xuống còn 192GB

HBM MASSIVE CONTENT DOWNGRADE ALERT🚨🚨: Nvidia Rubin Ultra will ship with 192GB of HBM4 8-hi. Not o…

DịchNvidia Rubin Ultra sẽ sử dụng 192GB HBM4 8-hi thay vì 1TB như dự kiến ban đầu. Sự sụt giảm này do thay đổi cấu trúc xếp chồng và sử dụng chip nhớ 24Gb, thấp hơn cả mức 288GB trên dòng Rubin tiêu chuẩn.

JiQiZhiXin
NgànhĐiểm AI 92/100

Tinh chọnMáy chủ NVIDIA tăng giá hơn 15%: Cơn đau đầu về bộ nhớ trong cuộc đua hạ tầng AI tỷ đô

NVIDIA thông báo tăng giá các dòng máy chủ AI chủ lực như Grace Blackwell và Vera Rubin từ đầu năm 2027. Nguyên nhân chính đến từ sự khan hiếm và chi phí đắt đỏ của bộ nhớ HBM, buộc các ông lớn công nghệ phải đối mặt với áp lực chi phí hạ tầng ngày càng tăng.


Vì sao đáng đọc: Tin tức quan trọng về chuỗi cung ứng AI, ảnh hưởng trực tiếp đến chi phí vận hành của các tập đoàn công nghệ lớn và xu hướng giá phần cứng toàn cầu.
Testing Catalog@testingcatalog
NgànhĐiểm AI 47/100

SpaceX hợp tác cùng NVIDIA đưa hệ thống siêu máy tính Vera Rubin lên quỹ đạo

SpaceX ❤️ NVIDIA SpaceX and NVIDIA designed a space-optimized Vera Rubin NVL72 system for an orbita…

DịchSpaceX và NVIDIA cùng phát triển hệ thống Vera Rubin NVL72 tối ưu cho không gian, dự kiến phóng vào cuối năm nay để tăng cường sức mạnh tính toán cho AI Grok và các vệ tinh Starmind thế hệ mới.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 35/100

NVIDIA áp đảo AMD về hiệu quả chi phí: Dùng chip NVIDIA vẫn rẻ hơn dù chip AMD được cho không

NVIDIA reaches up to 5x better cost efficiency than AMD at 150 tok/s/user on its GLM 5.3 SGLang comp…

DịchBáo cáo từ SemiAnalysis cho thấy tại mức 150 tok/s/user, hiệu quả chi phí của NVIDIA vượt trội gấp 5 lần AMD. Thậm chí nếu chip AMD miễn phí, tổng chi phí vận hành của NVIDIA vẫn thấp hơn nhờ tối ưu hóa phần mềm vượt trội.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 49/100

NVIDIA tích hợp công nghệ Groq vào hệ thống máy chủ rack-scale

8 months after NVIDIA's non-exclusive Groq licensing arrangement, Groq technology finally is appeari…

DịchNVIDIA chính thức đưa công nghệ Groq vào các hệ thống rack-scale mới, kết hợp GPU Rubin cho tính toán nặng và Groq 3 LPX để tối ưu tốc độ phản hồi, hứa hẹn hiệu suất nhanh gấp 4 lần so với Cerebras.

Epoch AI@EpochAIResearch
Nghiên cứuĐiểm AI 53/100

GDP Mỹ đang bị tính thiếu do bỏ qua đóng góp khổng lồ từ Nvidia

We discovered that US GDP statistics miss most of the value Nvidia adds to the US economy. As a res…

DịchNghiên cứu mới chỉ ra rằng cách tính GDP hiện tại của Mỹ đã bỏ lỡ phần lớn giá trị kinh tế mà Nvidia tạo ra, khiến tăng trưởng thực tế trong năm qua bị thấp hơn khoảng 0,3 điểm phần trăm.

24/08

Thứ Hai · 17 tin
Ars Technica: AI
NgànhĐiểm AI 67/100

Cùng sự kiệnĐài Loan khởi tố 9 người liên quan đường dây tuồn máy chủ AI sang Trung Quốc, nghi có quản lý cấp cao Nvidia

Cơ quan chức năng Đài Loan đã khởi tố 9 cá nhân vì làm giả giấy tờ để xuất khẩu trái phép máy chủ AI cao cấp sang Trung Quốc, vi phạm lệnh cấm vận của Mỹ. Vụ việc liên quan đến nhân sự cấp cao từ Nvidia và Supermicro, gây chấn động ngành công nghệ.

Cùng sự kiện, bài đại diện «Quản lý cấp cao Nvidia bị cáo buộc tuồn 74 máy chủ AI sang Trung Quốc»
Kim@kimmonismus
Sản phẩmĐiểm AI 48/100

NVIDIA Groq 3 LPX chính thức sản xuất: Thiết lập kỷ lục tốc độ tạo token mới

Inference on steroid: NVIDIA's Groq 3 LPX is now in full production, adding a dedicated token-genera…

DịchNVIDIA Groq 3 LPX đã đi vào sản xuất hàng loạt, đạt tốc độ kỷ lục 3400 token/giây khi chạy mô hình Gemma 4 31B. Công nghệ này sẽ sớm được triển khai trên nền tảng Vera Rubin thông qua Nebius và Groq.

Thêm 1 nguồn khác đưa tinX: Artificial Analysis (@ArtificialAnlys)
cb_doge@cb_doge
NgànhĐiểm AI 53/100

NVIDIA Vera CPU sẽ là 'trái tim' vận hành thế hệ Grok tiếp theo

BREAKING: NVIDIA just announced its Vera CPUs will power the next generation of Grok. SpaceXAI will…

DịchNVIDIA công bố chip Vera CPU sẽ cung cấp sức mạnh tính toán cho Grok. Sự hợp tác này giúp hạ tầng AI của xAI tối ưu hóa khả năng xử lý dữ liệu, thực thi mã nguồn và giải quyết các tác vụ phức tạp khi mở rộng quy mô lên mức gigawatt.

cb_doge@cb_doge
NgànhĐiểm AI 50/100

NVIDIA bắt tay SpaceX đưa sức mạnh tính toán AI lên quỹ đạo

NVIDIA on @SpaceXAI today: "SpaceXAI's work with NVIDIA is moving beyond AI factories on Earth. Sp…

DịchNVIDIA hợp tác cùng SpaceX triển khai hệ thống siêu máy tính Vera Rubin NVL72 lên vệ tinh Starmind, mang khả năng xử lý AI trực tiếp ngoài không gian bất chấp các giới hạn về năng lượng và tản nhiệt.

Thêm 1 nguồn khác đưa tinX: Testing Catalog (@testingcatalog)
NVIDIA Blog
Sản phẩmĐiểm AI 45/100

NVIDIA nâng cấp Vera Rubin cho hệ thống AI Agent, Groq 3 LPX chính thức đi vào sản xuất

NVIDIA mở rộng khả năng tạo token tốc độ cao trên nền tảng Vera Rubin NVL72 để tối ưu cho các hệ thống AI Agent. Đồng thời, hệ thống Groq 3 LPX đã được đưa vào sản xuất hàng loạt, tập trung vào sự phối hợp toàn diện giữa hạ tầng thay vì chỉ dựa vào sức mạnh đơn lẻ của chip.

Thêm 1 nguồn khác đưa tinIT Home
NVIDIA Blog
Sản phẩmĐiểm AI 63/100

Tinh chọnNVIDIA Vera Rubin NVL72 thiết lập chuẩn mực mới: Hiệu suất xử lý AI Agent tăng gấp 30 lần

Dữ liệu từ NVIDIA cho thấy Vera Rubin NVL72 giúp tăng lưu lượng xử lý trên mỗi megawatt lên gấp 30 lần và giảm chi phí trên mỗi triệu token xuống 35 lần so với thế hệ GB300 NVL72.

Thêm 1 nguồn khác đưa tinJiqizhixin

Vì sao đáng đọc: Tin tức quan trọng về phần cứng thế hệ mới của NVIDIA, tác động trực tiếp đến chi phí vận hành và hiệu suất của các hệ thống AI Agent quy mô lớn.
cb_doge@cb_doge
Sản phẩmĐiểm AI 36/100

Cùng sự kiệnNVIDIA hợp tác cùng SpaceXAI: Đưa chip Vera và nền tảng Rubin lên quỹ đạo để vận hành Grok

BREAKING: NVIDIA just announced that SpaceXAI will deploy Vera CPUs and the Vera Rubin platform to s…

DịchNVIDIA công bố SpaceXAI sẽ triển khai chip Vera chuyên dụng cho AI và nền tảng Rubin, giúp mở rộng hạ tầng của Grok từ mặt đất lên không gian với hiệu suất vượt trội gấp 1,8 lần so với CPU truyền thống.

Cùng sự kiện, bài đại diện «NVIDIA hé lộ cách SpaceXAI dùng CPU Vera để đưa AI thông minh lên quỹ đạo»
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 39/100

NVIDIA giới thiệu ACES: Phương pháp mới đánh giá kỹ năng của AI Agent

Very interesting new paper from NVIDIA. (bookmark it) It takes a closer look at evaluating agent s…

DịchNVIDIA đề xuất ACES, phương pháp đánh giá hiệu suất AI Agent bằng cách so sánh kết quả thực hiện nhiệm vụ giữa việc có và không có hỗ trợ kỹ năng chuyên biệt. Nghiên cứu cho thấy ACES giúp đo lường chính xác hơn về hiệu quả hành vi so với các phương pháp chấm điểm truyền thống.

Testing Catalog@testingcatalog
NgànhĐiểm AI 53/100

Cùng sự kiệnNVIDIA đàm phán đầu tư vào Perplexity với định giá 30 tỷ USD

NVIDIA ❤️ Perplexity NVIDIA is investing in Perplexity at $30B valuation, according to The Informa…

DịchNVIDIA đang thảo luận rót vốn vào startup tìm kiếm AI Perplexity với mức định giá 30 tỷ USD. Ngoài đầu tư, NVIDIA còn cân nhắc hợp tác cấp phép công nghệ và tuyển dụng nhân sự từ công ty này.

Cùng sự kiện, bài đại diện «NVIDIA dự kiến rót hàng tỷ USD vào startup tìm kiếm AI Perplexity»
Testing Catalog@testingcatalog
NgànhĐiểm AI 56/100

Cùng sự kiệnHugging Face được đồn đoán đang tìm kiếm thương vụ bán mình với giá 13 tỷ USD

Hugging Face is exploring a potential $13 billion sale, according to Business Insider. > Google, …

DịchTheo Business Insider, Hugging Face đang cân nhắc các phương án bán lại công ty với định giá 13 tỷ USD. Dù danh tính người mua chưa được tiết lộ, giới chuyên gia nhận định Nvidia có thể là ứng viên tiềm năng nhất.

Cùng sự kiện, bài đại diện «Startup AI Hugging Face cân nhắc bán mình với định giá lên tới 13 tỷ USD»
IT Home
NgànhĐiểm AI 55/100

NVIDIA dự kiến rót hàng tỷ USD vào startup tìm kiếm AI Perplexity

NVIDIA đang đàm phán đầu tư hàng tỷ USD vào Perplexity AI với mức định giá hơn 30 tỷ USD, đồng thời thảo luận về các thỏa thuận cấp phép công nghệ trong bối cảnh doanh thu của startup này tăng trưởng mạnh mẽ.

Thêm 3 nguồn khác đưa tinX: Testing Catalog (@testingcatalog)X: Kim (@kimmonismus)The Decoder: AI News

23/08

Chủ Nhật · 12 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 52/100

Nvidia chi 600 triệu USD mua bản quyền công nghệ từ Poolside để tăng tốc nghiên cứu AI

Nvidia reportedly agreed to pay $6B for a non-exclusive license to Poolside's model-building system….

DịchNvidia đã chi 600 triệu USD để sở hữu bản quyền nền tảng Model Factory của Poolside, giúp rút ngắn thời gian thử nghiệm từ vài tuần xuống còn một giờ, đồng thời rót thêm 1 tỷ USD đầu tư vào startup này với định giá 12 tỷ USD.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (49 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Nvidia” — Trang 14 | AIHOT.vn