Tin ngành
SenseTime khởi động dự án Galaxy: Tham vọng tự chủ hạ tầng chip AI tại Trung Quốc
(giờ Việt Nam)
Tóm tắt AI
SenseTime vừa ra mắt dự án Galaxy, hợp tác cùng gần 20 đối tác nhằm xây dựng hệ sinh thái chip AI nội địa khép kín, từ công nghệ phần cứng đến ứng dụng thực tế.
Bản dịch AI

SenseTime đã khởi động Dự án Galaxy, hợp tác với gần 20 đối tác để mở rộng quy mô cơ sở hạ tầng chip AI nội địa tại Trung Quốc.
Trong bài phát biểu chính với tiêu đề ‘Chuyển đổi thông minh và Cộng sinh’, Yang Fan – đồng sáng lập kiêm chủ tịch Nhóm Kinh doanh Thiết bị Lớn của công ty – đã trình bày về cái mà SenseTime mô tả là một vòng lặp khép kín kết nối công nghệ cấp chip, quan hệ đối tác hệ sinh thái và triển khai thương mại cho sức mạnh tính toán AI sản xuất trong nước.
Bên cạnh Dự án Galaxy, SenseTime đã ký thỏa thuận về điện toán không gian với nhà sản xuất vệ tinh Guoxing Aerospace và thiết lập quan hệ đối tác nghiên cứu với năm tổ chức – bao gồm Phòng thí nghiệm Trí tuệ nhân tạo Thượng Hải – nhằm mục đích ứng dụng vào tính toán khoa học.
Yang định hình thời điểm này dựa trên ba xu hướng hội tụ: nhu cầu về token tăng cao trong các triển khai doanh nghiệp, việc áp dụng AI công nghiệp bắt kịp các trường hợp sử dụng hướng tới người tiêu dùng, và quá trình thương mại hóa chip nội địa đạt đến điểm mà các trung tâm tính toán thông minh xây dựng trên nền tảng silicon Trung Quốc có thể được thiết lập với tốc độ nhanh chóng.
Tuy nhiên, liệu "cửa sổ cơ hội" đó có rộng mở như SenseTime tuyên bố hay không còn phụ thuộc rất nhiều vào các con số mà công ty chưa được bên thứ ba kiểm chứng độc lập.
Các số liệu về lưu lượng token cần được xem xét thận trọng.
SenseTime cho biết nền tảng thiết bị quy mô lớn của họ hiện xử lý trung bình 2,42 nghìn tỷ token mỗi ngày và công ty dự báo con số đó sẽ tăng gấp 25 lần lên 10 nghìn tỷ token mỗi ngày vào quý 4 năm 2026. Đó là một dự báo, không phải kết quả đo lường thực tế, và các khách hàng doanh nghiệp khi đánh giá cơ sở hạ tầng của SenseTime nên coi đó là dự báo cho đến khi các số liệu hàng quý được công bố.
Các tuyên bố về hiệu quả chi phí đi kèm với sự tăng trưởng đó cũng là số liệu do công ty tự báo cáo. SenseTime cho biết công nghệ suy luận lai không đồng nhất của họ mang lại mức tăng từ 85–152% trong việc sử dụng Model FLOPs trên các dòng chip nội địa phổ biến, cùng với hiệu quả chi phí suy luận mà công ty khẳng định gấp 1,25 lần so với các dòng chip H-series của Nvidia.
So với các thiết lập suy luận đồng nhất trong nước, SenseTime tuyên bố mức tăng gấp 2,5 lần về sản lượng token với chi phí tương đương, một bước nhảy vọt mà họ cho rằng giúp các cụm suy luận lai được tối ưu hóa vượt qua ngưỡng lợi nhuận tối thiểu mà ngành công nghiệp từng đặt ra cho sức mạnh tính toán nội địa.
Không có số liệu nào trong số này đi kèm với đánh giá từ bên thứ ba, và khoảng cách giữa cụm thử nghiệm được tối ưu hóa của nhà cung cấp với môi trường sản xuất thực tế của khách hàng – với các đường ống dữ liệu không đồng đều và cập nhật firmware bị trì hoãn – thường là nơi các con số này trở nên kém thuyết phục hơn.
Các tuyên bố về khả năng thích ứng và bài toán đa chip.
Các chip AI nội địa từ trước đến nay gặp khó khăn với hệ sinh thái phần mềm phân mảnh: các mô hình được huấn luyện cho một kiến trúc thường cần phải làm lại để chạy trên kiến trúc khác. SenseTime cho biết họ đã xây dựng một lớp thích ứng toàn diện (full-stack) bao gồm các mô hình, khung làm việc, toán tử, chuỗi công cụ và phần cứng để giải quyết vấn đề này, với mục tiêu cho phép khách hàng di chuyển khối lượng công việc giữa các nhà cung cấp chip nội địa mà không cần viết lại mã nguồn quá nhiều.
Công ty chỉ ra hai ví dụ ứng dụng. Trong khối lượng công việc dự đoán chuỗi protein dài AI4S, SenseTime cho biết việc tối ưu hóa toán tử hợp nhất đã cắt giảm thời gian dự đoán tổng thể xuống ba lần. Trong tạo video AIGC, họ tuyên bố tỷ lệ tăng tốc song song đa card đạt 93% đối với các chip nội địa chạy mô hình DiT, cùng với cái mà họ mô tả là khả năng di chuyển không tốn phí cho các công cụ phát triển AI phổ biến.
Đây là những con số trông rất ấn tượng trong môi trường thử nghiệm (sandbox) và sẽ có ý nghĩa hơn nhiều khi được kiểm tra áp lực thực tế trên các đường ống dữ liệu của khách hàng với các thế hệ phần cứng hỗn hợp.
Các chỉ số năng lượng có tên gọi chuẩn mực mới.
SenseTime đã giới thiệu một chỉ số mà họ gọi là Tokens Per Watt (Token trên mỗi Watt), được định vị là thước đo thay thế để đo lường hiệu quả của trung tâm dữ liệu AI, cùng với Tác nhân Cộng tác Sức mạnh Tính toán (Computing-Power Collaboration Agent) giúp xử lý việc lập lịch tài nguyên, dự đoán giá điện và tối ưu hóa lưu trữ năng lượng trên hệ thống dữ liệu tám cấp với năm chuỗi quyết định.
Kết hợp giữa tính toán, giá điện và lập lịch tự động, SenseTime tuyên bố tăng 80% sản lượng token trên mỗi đơn vị chi phí điện, giá điện trung bình thấp hơn 10% so với các trung tâm dữ liệu khu vực tương đương và độ chính xác 96% trong dự đoán tải tính toán.
Đây là những tuyên bố đáng theo dõi trong vài quý tới thay vì chấp nhận ngay lập tức. Việc chênh lệch giá điện và độ chính xác trong dự báo tải thường có kết quả khác biệt khi hệ thống vận hành qua một chu kỳ theo mùa đầy đủ với sự biến động nhu cầu thực tế, thay vì các điều kiện mà nhà cung cấp thường sử dụng trong các dự án thí điểm.
Danh sách đối tác ấn tượng trải dài từ các nhà sản xuất chip đến nhà cung cấp linh kiện.
Hệ sinh thái của Dự án Galaxy bao gồm các nhà cung cấp chip nội địa như Cambricon, Muxi, Hygon, Huawei Ascend, Moore Threads, Sunrise và Biren Technology; đối tác linh kiện Xizhi Technology; và các công ty cơ sở hạ tầng bao gồm Silicon Motion, Qujing Technology, Zhongke Jiahe, Qingcheng Jizhi, Sophon Information và Jiliu Technology.
SenseTime cho biết kế hoạch bao gồm việc xây dựng một "nhà máy token", năm cụm tính toán ở quy mô mà họ gọi là "10.000 calo", hợp tác chung trên mười hướng công nghệ và hỗ trợ cho 200 startup AI.
"Sản xuất nội địa không chỉ đơn thuần là thay thế từng con chip riêng lẻ, mà là một nỗ lực hợp tác trên toàn bộ chuỗi năng lực đổi mới của Trung Quốc, từ chip và linh kiện đến cơ sở hạ tầng và các kịch bản ứng dụng," Yang nói.
Các khoản đầu tư vào điện toán không gian, quang học và lượng tử vẫn còn ở tương lai xa.
Ngoài cơ sở hạ tầng ngắn hạn, SenseTime đã vạch ra công việc về điện toán quang học cho hiệu quả trung tâm dữ liệu, ứng dụng điện toán lượng tử trong tối ưu hóa AI và quan hệ đối tác điện toán không gian với Guoxing Aerospace để xây dựng cái mà hai công ty gọi là Chòm sao Điện toán Không gian SenseTime.
Kế hoạch của SenseTime kêu gọi phóng vệ tinh đầu tiên vào năm 2026, hướng tới mục tiêu hàng nghìn vệ tinh tính toán và năng lực tính toán đạt hàng chục nghìn petabyte vào năm 2030.
Yang lập luận rằng giá trị này vượt xa khả năng thuần túy, định hình điện toán dựa trên không gian như một cách để mở rộng phạm vi tiếp cận của các dịch vụ AI Trung Quốc vào các môi trường mạng yếu như hoạt động hàng hải và ứng phó thiên tai, từ đó hỗ trợ xuất khẩu AI của Trung Quốc ra quốc tế.
Mục tiêu năm 2030 đó còn cách 5 năm nữa, và các triển khai điện toán vệ tinh ở quy mô này chưa có tiền lệ để đo lường tiến độ.
Cơ sở hạ tầng vật lý trải dài từ Thượng Hải đến Riyadh.
Trên thực tế, SenseTime cho biết cơ sở tại Thượng Hải của họ vận hành trung tâm dữ liệu đầu tiên của đất nước được xếp hạng ở mức "5A" về tính toán thông minh, xử lý hơn 20 nghìn tỷ token mỗi ngày trên hơn 20 ngành công nghiệp. Một địa điểm tại Diêm Thành đã đi vào hoạt động với năng lực ban đầu 3.000 petaflops, tập trung vào các ứng dụng năng lượng, sản xuất và kinh tế tầm thấp.
Tại Hồng Kông, SenseTime đang xây dựng trung tâm tính toán thông minh nội địa lớn nhất của lãnh thổ này, với mục tiêu đạt 40.000 petaflops vào năm 2030. Công ty cũng lên kế hoạch cho cái mà họ gọi là cụm tính toán nội địa ở nước ngoài đầu tiên của Trung Quốc tại Ả Rập Xê Út, được định vị là cơ sở tính toán nội địa toàn diện cho khu vực Trung Đông.
Về phía nghiên cứu, sự hợp tác của SenseTime với Phòng thí nghiệm AI Thượng Hải, Học viện Trung Quan Thôn Bắc Kinh, Học viện Hetao Thâm Quyến, Viện Nghiên cứu Đổi mới Thuật toán Thượng Hải và trường AI của Đại học Giao thông Thượng Hải nhằm xây dựng một nền tảng chia sẻ bao gồm tính toán, công cụ và năng lực mô hình cho khoa học sự sống, khoa học vật liệu và nghiên cứu sản xuất. Yang gọi AI for Science là "đòn bẩy quan trọng cho sự đổi mới mô hình trong nghiên cứu cơ bản", gắn sáng kiến này với chính sách "Trí tuệ nhân tạo+" rộng lớn hơn của Trung Quốc.
Dự báo của SenseTime về 10 nghìn tỷ token mỗi ngày vào quý 4 năm 2026 là con số cần theo dõi so với những gì công ty báo cáo khi quý đó thực sự kết thúc.
Xem thêm: Mô hình trọng số mở Kimi K3: AI lớn nhất Trung Quốc là một canh bạc vào bộ nhớ, không phải sức mạnh tính toán.

Bạn muốn tìm hiểu thêm về AI và dữ liệu lớn từ các nhà lãnh đạo ngành? Hãy xem AI & Big Data Expo diễn ra tại Amsterdam, California và London. Sự kiện toàn diện này là một phần của TechEx và được tổ chức cùng với các sự kiện công nghệ hàng đầu khác bao gồm Cyber Security & Cloud Expo. Nhấp vào đây để biết thêm thông tin.
AI News được vận hành bởi TechForge Media. Khám phá các sự kiện và hội thảo trực tuyến về công nghệ doanh nghiệp sắp tới tại đây.
Bài viết được AI dịch và tổng hợp tự động từ Artificial Intelligence News. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.