QbitAI
85

Tin ngành

QJing Tech hợp tác với Moore Threads: Giải pháp AI Token nội địa vượt mặt đối thủ quốc tế về hiệu năng

(giờ Việt Nam)

Tóm tắt AI

Sự kết hợp giữa QJing Tech và Moore Threads mang đến giải pháp tính toán dị thể nội địa, tối ưu hóa hiệu suất sản xuất AI Token với chi phí cạnh tranh hơn so với các giải pháp quốc tế.

Bản dịch AI

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

04/09/2026 17:23:24 Nguồn: QbitAI

Card đồ họa nội địa đạt hiệu suất sản xuất AI Token chất lượng cao

Ngày 3 tháng 9, Qujing Technology và Moore Threads đã ký kết thỏa thuận hợp tác chiến lược. Dựa trên sự kết hợp sâu rộng giữa công nghệ PD dị thể nội địa do Qujing Technology tự phát triển với card tính toán thông minh MTT S5000 và nền tảng phần mềm MUSA của Moore Threads, hai bên sẽ tiếp tục thúc đẩy xây dựng nhà máy AI Token chất lượng cao nội địa hóa dựa trên nền tảng ATaaS của Qujing Technology, đồng thời cùng nghiên cứu phát triển và quảng bá các giải pháp liên kết với Token Pod (siêu nút Token) làm vật mang.

Hiện tại, các giải pháp liên quan đã được đưa vào sản xuất và tiếp nhận lưu lượng Token thực tế từ các doanh nghiệp mô hình hàng đầu. Với cùng tiêu chuẩn dịch vụ sản xuất, giải pháp này vừa đảm bảo hiệu suất cấp sản xuất của năng lực tính toán nội địa, vừa có lợi thế về chi phí trên mỗi AI Token, với hiệu suất chi phí tổng thể vượt trội so với các giải pháp tính toán tiên tiến quốc tế. Bước tiến này cũng đánh dấu việc Qujing Technology hợp tác cùng Moore Threads, tiên phong thúc đẩy suy luận dị thể PD nội địa đi vào môi trường sản xuất.

Tổng giám đốc bộ phận Token của Qujing Technology, ông Lưu Hiển Hách, và Phó tổng giám đốc bộ phận kinh doanh chiến lược của Moore Threads, ông Phí Tĩnh Nhiên, đã đại diện hai bên ký kết thỏa thuận. Giáo sư Đại học Thanh Hoa kiêm nhà khoa học trưởng của Qujing Technology, ông Vũ Vĩnh Vệ; nhà sáng lập kiêm CEO của Qujing Technology, ông Ngải Trí Viễn; Chủ tịch kiêm CFO, bà Vũ Văn Khiết; Kiến trúc sư trưởng, ông Tạ Uy Vũ; cùng nhà sáng lập, Chủ tịch kiêm CEO của Moore Threads, ông Trương Kiến Trung; Phó chủ tịch cấp cao Đổng Long Phi; Phó chủ tịch cấp cao La Văn Dũng và các đại diện khác đã tham dự lễ ký kết.

Card đồ họa nội địa đạt hiệu suất sản xuất AI Token cấp sản xuất

Hiệu suất chi phí vượt trội so với các giải pháp tính toán tiên tiến quốc tế.

Khi các ứng dụng mô hình lớn bước vào giai đoạn thương mại hóa quy mô lớn, sự cạnh tranh về cơ sở hạ tầng đang chuyển dịch từ hiệu suất đơn card sang hiệu suất sản xuất Token cấp hệ thống. Chìa khóa để đo lường giá trị thương mại của một bộ giải pháp không chỉ nằm ở việc phần cứng có thể chạy được mô hình hay không, mà còn phải đo lường chi phí sản xuất cho mỗi AI Token chất lượng cao dưới các mục tiêu dịch vụ đã định.

Lợi thế về hiệu suất chi phí của giải pháp liên kết giữa Qujing Technology và Moore Threads không chỉ đơn thuần đến từ sự khác biệt về giá phần cứng, mà bắt nguồn từ việc tối ưu hóa tài nguyên cho hai giai đoạn Prefill và Decode. Trong đó, MTT S5000 của Moore Threads chịu trách nhiệm tính toán đầu vào và tạo KV Cache cho giai đoạn Prefill, phối hợp làm việc với GPU băng thông cao đảm nhận việc tạo Token ở giai đoạn Decode.

Nhờ năng lực tính toán AI mật độ cao, độ chính xác FP8 nguyên bản, cùng hệ sinh thái và ngăn xếp phần mềm MUSA hoàn thiện, MTT S5000 hỗ trợ tách biệt Prefill khỏi chuỗi suy luận truyền thống, xây dựng thành hồ tài nguyên tính toán có thể cung cấp độc lập, tính phí độc lập và tối ưu hóa độc lập. Qujing Technology dựa vào công nghệ PD dị thể nội địa tự phát triển để hoàn thiện việc tối ưu hóa sâu mô hình và phối hợp liên thiết bị, cuối cùng tích hợp các loại tài nguyên tính toán khác nhau thành dịch vụ suy luận đầu cuối thống nhất, ổn định và có hiệu suất chi phí cao.

Cấu hình này giúp giảm bớt sự chiếm dụng tài nguyên chi phí cao trong giai đoạn Prefill, đồng thời tránh việc phải cấu hình toàn bộ cơ sở hạ tầng theo nhu cầu đỉnh điểm của một giai đoạn đơn lẻ. Theo tiêu chuẩn dịch vụ sản xuất hiện tại của dự án, hồ tài nguyên Prefill gồm 4 đến 5 card MTT S5000 có hiệu suất chi phí xử lý Token đầu vào vượt trội so với các giải pháp tính toán tiên tiến quốc tế.

Điều này có nghĩa là năng lực cạnh tranh của tính toán nội địa đang mở rộng từ hiệu suất đơn card sang hiệu suất sản xuất Token cấp hệ thống. Thông qua sự phối hợp sâu sắc giữa phần cứng nội địa và công nghệ PD dị thể, Qujing Technology và Moore Threads đã cung cấp một lộ trình tính toán nội địa vừa đảm bảo hiệu suất cấp sản xuất vừa tối ưu chi phí cho việc suy luận quy mô lớn các mô hình lớn hàng nghìn tỷ tham số.

Từ "xác thực trong môi trường thí nghiệm" tiến tới "triển khai sản xuất quy mô lớn".

Hiệu suất chi phí có thực sự hiệu quả hay không, cuối cùng vẫn phải được kiểm chứng bởi nghiệp vụ thực tế. Môi trường sản xuất cần đối mặt với các yêu cầu phức tạp như lưu lượng truy cập cao, ngữ cảnh siêu dài và biến động lưu lượng liên tục, điều này đặt ra yêu cầu cao hơn đối với việc quản lý bộ nhớ video, phối hợp liên thiết bị và độ ổn định dịch vụ của tính toán nội địa.

Dữ liệu vận hành sản xuất cho thấy, sự phối hợp giữa MTT S5000 của Moore Threads và giải pháp PD dị thể nội địa của Qujing Technology, trong các kịch bản nghiệp vụ phức tạp của các mô hình lớn hàng đầu nội địa, đã đạt tốc độ tạo Token trung bình hơn 50 TPS, tỷ lệ trúng KV Cache trên 90%, độ ổn định 99,9% và đảm bảo độ trễ Token đầu tiên (TTFT) thấp ở cấp sản xuất, thực sự chuyển hóa năng lực tính toán nội địa thành năng lực sản xuất AI Token quy mô lớn và chất lượng cao.

Sau nhiều vòng lặp hiệu suất và tối ưu hóa chuyên biệt giữa Qujing Technology và Moore Threads, MTT S5000 đã vượt qua giai đoạn tương thích mô hình và kiểm thử xác thực, chính thức bước vào chuỗi sản xuất AI Token chất lượng cao.

Triết lý "ít mô hình, tối ưu sâu" tiếp tục được kiểm chứng.

Các thành quả sản xuất nêu trên cũng là sự thể hiện tập trung cho lộ trình kỹ thuật "ít mô hình, tối ưu sâu" của Qujing Technology. Bằng cách tập trung tối ưu hóa các mô hình trọng điểm, Qujing Technology chuyển hóa năng lực phần cứng của GPU nội địa thành năng lực sản xuất AI Token ổn định, có thể bàn giao, hình thành nên năng lực sản xuất có khả năng tái sử dụng.

Triết lý "ít mô hình, tối ưu sâu" mà Qujing Technology kiên trì theo đuổi là tập trung kỹ thuật cốt lõi vào các mô hình trọng điểm có nhu cầu quy mô lớn rõ ràng, triển khai tối ưu hóa liên tục xung quanh mô hình, chip, hệ thống suy luận và tải nghiệp vụ thực tế. Tiêu chuẩn đo lường cuối cùng là liệu có thể đảm bảo đồng thời độ trễ, thông lượng, độ ổn định, độ chính xác, xử lý ngữ cảnh dài và chi phí trong vận hành thực tế hay không, để liên tục tạo ra các AI Token chất lượng cao.

Triết lý này cũng xuyên suốt quá trình thiết kế và triển khai giải pháp PD dị thể nội địa lần này. Qujing Technology hoàn thiện thiết kế giải pháp suy luận dị thể tách biệt PD dựa trên đặc điểm nhiệm vụ của hai giai đoạn Prefill và Decode, đồng thời cùng Moore Threads hoàn thành tối ưu hóa sâu cho MTT S5000 với mô hình, hệ thống suy luận và môi trường vận hành. Hai bên sử dụng lưu lượng trực tuyến để liên tục kiểm tra hiệu quả tối ưu hóa, đồng thời lặp lại cấu hình mô hình và chiến lược dịch vụ dựa trên kết quả vận hành, giúp nâng cao hiệu suất từ các tham số thí nghiệm thành sản lượng AI Token chất lượng cao ổn định, qua đó xác thực thêm tính hiệu quả của "ít mô hình, tối ưu sâu" trong các kịch bản sản xuất dị thể nội địa.

Cấu hình mô hình, đặc điểm lưu lượng và chiến lược vận hành hình thành trong quá trình này tiếp tục được đúc kết vào nền tảng ATaaS, tạo thành năng lực sản xuất có thể tái sử dụng.

Liên minh mạnh mẽ.

Xây dựng nhà máy AI Token chất lượng cao nội địa hóa.

Mục tiêu cốt lõi của sự hợp tác chiến lược lần này giữa Qujing Technology và Moore Threads nằm ở việc phát huy tối đa lợi thế của cả hai bên về hệ thống suy luận, vận hành sản xuất và nền tảng phần cứng/phần mềm GPU nội địa, cùng nhau xây dựng nhà máy AI Token nội địa hóa có khả năng tiếp nhận nghiệp vụ thực tế và sản xuất liên tục các AI Token chất lượng cao.

Xung quanh mục tiêu này, hai bên sẽ cùng tung ra giải pháp sản xuất Token tích hợp phần cứng và phần mềm dựa trên Token Pod (siêu nút Token). Moore Threads cung cấp card tính toán thông minh MTT S5000 và nền tảng phần mềm MUSA; Qujing Technology lấy Token Pod làm vật mang bàn giao, tích hợp sâu phần cứng liên quan với hệ thống suy luận dị thể PD nội địa tự phát triển, nền tảng ATaaS và dịch vụ vận hành, hình thành nên cụm suy luận chuyên dụng bao phủ từ cơ sở hạ tầng, tối ưu hóa suy luận, quản lý nền tảng đến vận hành liên tục.

Để thúc đẩy giải pháp liên kết từ các dự án đã đưa vào sản xuất tiến tới bàn giao tiêu chuẩn hóa, hai bên sẽ tiếp tục đúc kết kinh nghiệm thích ứng mô hình, phối hợp liên thiết bị và vận hành sản xuất hình thành trong các dự án PD dị thể nội địa vào Token Pod. Dựa trên các khả năng như chia sẻ KV Cache, cấu hình nhận diện lưu lượng, mở rộng linh hoạt và cách ly lỗi, Token Pod có thể thích ứng với các tổ hợp phần cứng nội địa và quốc tế phổ biến, hình thành các đơn vị sản xuất Token có thể cấu hình và mở rộng theo nhu cầu nghiệp vụ, đẩy nhanh việc triển khai các giải pháp liên kết vào các dự án cụ thể.

Việc sao chép liên tục các giải pháp liên quan được xây dựng trên nền tảng sản xuất hiện có của Qujing Technology. Tính đến tháng 8 năm 2026, Qujing Technology đã hoàn thành việc cùng xây dựng các dự án sản xuất AI Token chất lượng cao quy mô hàng nghìn tỷ mỗi ngày, đồng thời hình thành năng lực sản xuất AI Token chất lượng cao quy mô hàng trăm tỷ mỗi ngày tại nhiều dự án, tích lũy kinh nghiệm dự án cho việc hai bên tiếp tục xây dựng và vận hành các nhà máy AI Token chất lượng cao nội địa hóa với quy mô lớn hơn.

Là đơn vị tiên phong thực hiện suy luận hỗn hợp dị thể nội địa, Qujing Technology thúc đẩy triển khai giải pháp PD dị thể nội địa theo tiêu chuẩn cấp sản xuất, trên cơ sở đảm bảo tính tin cậy về chức năng và độ chính xác, liên tục thực hiện tối ưu hóa hiệu suất công cụ chuyên sâu, giúp năng lực phần cứng của GPU nội địa thực sự chuyển hóa thành sản lượng AI Token chất lượng cao.

Trong tương lai, Qujing Technology và Moore Threads sẽ tiếp tục làm sâu sắc thêm sự liên kết kỹ thuật, cùng xây dựng tiêu chuẩn và hợp tác hệ sinh thái, mở rộng hợp tác trong các ngành công nghiệp nền tảng trọng yếu của quốc gia như doanh nghiệp internet, các công ty mô hình nền tảng tiên phong, các nhà mạng, thúc đẩy suy luận dị thể PD nội địa đi vào các kịch bản ứng dụng sản xuất rộng rãi hơn.

Bài viết này do Qujing Technology cung cấp, QbitAI được ủy quyền đăng tải lại, quan điểm thuộc về tác giả gốc.

Bản quyền thuộc về tác giả, không được phép sao chép và sử dụng dưới mọi hình thức khi chưa được ủy quyền, mọi hành vi vi phạm sẽ bị xử lý theo quy định.

量子位的朋友们
AI nội địaMoore ThreadsPhần cứng AIQJing TechChip AI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.