IT Home
85

Tin ngành

Trung Quốc ra mắt hệ thống suy luận AI lai giữa GPU nội địa và chip mô phỏng não bộ, tăng gấp đôi hiệu năng chi phí

(giờ Việt Nam)

Tóm tắt AI

Hệ thống mới kết hợp GPU nội địa và chip mô phỏng não bộ giúp tối ưu hóa suy luận mô hình lớn như DeepSeek V4, giảm 40% chi phí vận hành bằng cách phân tách tác vụ Attention và FFN thông minh.

Bản dịch AI

Theo tin từ IT ngày 13 tháng 9, Hội nghị Điện toán Trung Quốc 2026 đã diễn ra tại Lang Phường, Hà Bắc từ ngày 11 đến ngày 13 tháng 9.

Hệ thống suy luận hỗn hợp dị thể (heterogeneous hybrid inference system) cho mô hình lớn đầu tiên tại Trung Quốc, kết hợp giữa GPU nội địa và chip mô phỏng não bộ (neuromorphic chip), đã chính thức được ra mắt. Hệ thống này được đồng phát triển bởi Mobile Cloud cùng với Viện Nghiên cứu Nam Hồ thuộc Tập đoàn Công nghệ Điện tử Trung Quốc (CETC), Beijing Lingxi Technology, Shanghai Iluvatar CoreX, Đại học Thanh Hoa và Đại học Bắc Kinh.

Theo thông tin IT nắm được, qua kiểm thử thực tế với Deepseek V4, hệ thống này mang lại hiệu suất chi phí cao gấp đôi so với các cụm tính toán GPU nội địa cùng loại, đồng thời giúp giảm hơn 40% chi phí vận hành nghiệp vụ.

Theo giới thiệu, thành quả này có khả năng thích ứng rộng rãi với các kịch bản đòi hỏi tính thời gian thực cao như Token Factory, tạo mã AI, phối hợp đa tác nhân (multi-agent), sản xuất thông minh, đồng thời cung cấp nền tảng suy luận nội địa hóa toàn diện cho các ngành nhạy cảm về bảo mật như tài chính, an ninh và viễn thông.

Phía đơn vị phát triển cho biết, tư duy cốt lõi của hệ thống này là "chia để trị, phối hợp tăng hiệu quả", thực hiện tách PD / AF cho mô hình lớn và triển khai các mô-đun khác nhau lên loại chip phù hợp nhất. Các phép tính Attention được giao cho GPU nội địa để phát huy ưu thế tính toán đa năng. Các mô-đun nhạy cảm với độ trễ như FFN (MOE experts) được giao cho chip mô phỏng não bộ, tận dụng ưu thế kiến trúc tính toán tại bộ nhớ (compute-in-memory) và SRAM dung lượng lớn trên chip. Thông qua trình biên dịch mô hình tự phát triển, giao thức kết nối tốc độ cao và công cụ suy luận thống nhất, hệ thống thực hiện việc phân tách tác vụ, điều phối phối hợp và tổng hợp kết quả cho hai loại năng lực tính toán, từ đó phá vỡ hoàn toàn các nút thắt cố hữu của suy luận trên GPU đơn lẻ truyền thống.

GPU nội địaChip mô phỏng não bộHạ tầng AISuy luận AICông nghệ Trung Quốc
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.