QbitAI
85

Tin ngành

OpenAI ra mắt chip AI 'Strawberry': Cú sốc cho Nvidia nhưng cổ phiếu Jensen Huang vẫn tăng mạnh

(giờ Việt Nam)

Tóm tắt AI

OpenAI vừa công bố chip AI tự phát triển mang tên mã 'Strawberry' mà không thông qua Nvidia. Dù được dự báo là đối thủ cạnh tranh trực tiếp, thị trường phản ứng tích cực khi cổ phiếu Nvidia vẫn tăng trưởng ổn định.

Bản dịch AI

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

26/08/2026 09:24:47 Nguồn: QbitAI

Không cần bàn bạc với "lão Hoàng" (Jensen Huang)

Jay đưa tin từ AoFeiSi

QbitAI | Kênh chính thức QbitAI

Đảo lộn trật tự rồi các bạn ơi.

Vừa mới đây, con chip tự nghiên cứu mang tên "Little Chili" (Tiểu Lạt Tiêu) của OpenAI đã có điểm benchmark nghiền nát dòng Blackwell mạnh nhất của NVIDIA...

Với mức tiêu thụ điện năng 700W, hiệu suất thông lượng trên mỗi watt cao gấp 1,9 lần và độ trễ suy luận thấp hơn tới 3,6 lần.

Đây không phải là thông cáo báo chí chính thức, dữ liệu này đến từ SemiAnalysis, một tổ chức nghiên cứu chuyên sâu về bán dẫn, họ đã được mời đến phòng thí nghiệm của OpenAI để đo đạc thực tế.

Thông thường, chip thế hệ đầu tiên thường không có tính cạnh tranh cao.

Nhưng kết luận cuối cùng mà SemiAnalysis đưa ra là——

Con chip thế hệ đầu tiên này của OpenAI có thể đánh bại Blackwell trong hầu hết mọi kịch bản.

Độ trễ thấp, thông lượng cao, độ đồng thời thấp... tất cả đều đạt cấp độ SOTA (State-of-the-Art).

Được biết, Codex đã đóng một vai trò rất quan trọng trong quá trình này, một số nhân (kernel) do AI viết thậm chí còn có hiệu năng tốt hơn cả do con người viết.

Đây cũng có thể coi là một biểu hiện của sự tự tiến hóa.

Điều thú vị là cổ phiếu của NVIDIA không những không lao dốc mà còn tăng 2,19%...

Một mặt, NVIDIA có sản phẩm mới.

Cùng ngày bị "Little Chili" nhắm tới, NVIDIA đã ra mắt máy tính robot Jetson Orin Nano 2.

Mặt khác, có lẽ cũng liên quan đến thái độ của OpenAI.

Sau khi điểm benchmark của "Little Chili" được công bố, công ty vẫn khẳng định rõ ràng sẽ không từ bỏ NVIDIA, việc huấn luyện vẫn sử dụng lượng lớn chip NVIDIA, và hai bên vẫn có sự hợp tác với các cam kết tài chính đảm bảo.

Đảo lộn trật tự! Chip OpenAI nghiền nát Blackwell

Tháng 6 năm nay, OpenAI chính thức công bố hợp tác với Broadcom để sản xuất con chip chuyên dụng cho suy luận này, có tên là "Little Chili", quá trình thiết kế bắt đầu từ giữa năm 2024, chỉ mất khoảng 16 tháng từ khi lập nhóm đến khi hoàn thiện băng từ (tape-out).

Ngày 25 tháng 8, OpenAI đã công khai con chip tự nghiên cứu này tại hội nghị Hot Chips 2026.

Đồng thời, nhiều chi tiết "ngầm" khác cũng bắt đầu lộ diện.

SemiAnalysis được mời mang theo bộ công cụ benchmark InferenceX của riêng họ đến phòng thí nghiệm OpenAI để đo đạc tại chỗ.

Kết luận là, con chip thế hệ đầu tiên này đã đánh bại tất cả các chip của NVIDIA, AMD và Google mà họ có thể đo đạc được trên nhiều mô hình mã nguồn mở phổ biến.

Hiệu quả năng lượng là điểm sáng lớn nhất.

Công suất thiết kế nhiệt (TDP) của "Little Chili" chỉ là 700W, trong khi card tăng tốc flagship Blackwell nằm trong khoảng 1200W đến 1400W. SemiAnalysis đo đạc thực tế cho thấy, thông lượng suy luận trên mỗi kilowatt của nó đạt gấp 1,5 đến 1,9 lần so với hệ thống rack GB200 NVL72 và GB300 NVL72.

Độ trễ cũng rất ấn tượng.

Độ trễ suy luận end-to-end thấp hơn 1,7 đến 3,6 lần so với kết quả tốt nhất của GB200 NVL72 và GB300 NVL72 mà NVIDIA ghi nhận, và nhanh hơn 2,1 đến 4,1 lần trong các kịch bản độ trễ siêu thấp.

Ở thiết lập tốc độ xuất nhanh nhất của GB300, thông lượng trên mỗi kilowatt cao hơn từ 8,6 đến 104,3 lần.

Các mô hình dùng để benchmark là ba mô hình lớn mã nguồn mở: GPT-OSS 120B, DeepSeek R1 670B và Kimi K2.5 của Moonshot AI (1 nghìn tỷ tham số).

Ở độ đồng thời thấp, GPT-OSS và Kimi K2.5 đạt khoảng 1400 token mỗi giây mỗi người dùng, DeepSeek R1 đạt hơn 700 token mỗi giây mỗi người dùng ở độ đồng thời bằng 1.

Tại điểm độ đồng thời thấp 100 token mỗi giây, hiệu suất trên Kimi K2.5 cao gấp hơn 9 lần so với chip tốt thứ hai. Thông lượng trên mỗi megawatt của GPT-OSS ở cùng mức độ tương tác gần gấp đôi điểm thông lượng cao nhất của GB200, và cao hơn 50 lần ở điểm độ đồng thời bằng 1.

Độ chính xác cũng không hề thua kém, kết quả đánh giá GSM8k ngang bằng với chip của NVIDIA.

Tuy nhiên, cũng cần phải làm rõ các thông số này.

OpenAINvidiaChip AIStrawberryPhần cứng
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.