Sản phẩm
Arm ra mắt CSS for Mobile 2: Nền tảng chip di động tích hợp kép nhân SME2 và GPU tăng tốc AI
(giờ Việt Nam)
Tóm tắt AI
Arm vừa giới thiệu hệ thống tính toán di động thế hệ thứ hai CSS for Mobile 2, trang bị CPU C2, GPU Mali G2-Ultra NX và hệ thống kết nối SI L2, tối ưu hóa cho các tác vụ AI Agent và đồ họa AI nguyên bản.
Bản dịch AI
Theo tin từ IT ngày 8 tháng 9, Arm đã tổ chức sự kiện thường niên Arm Everywhere China tại Thượng Hải và công bố Compute Subsystems (CSS) for Mobile 2, thế hệ thứ hai của hệ thống con tính toán dành cho thiết bị di động. Đây là nền tảng tính toán hướng tới AI tác tử (Agent AI) và đồ họa AI nguyên bản (AI-native graphics), tích hợp cụm CPU Arm C2, GPU Mali G2-Ultra NX và hệ thống kết nối SI L2, đồng thời hợp nhất các IP hệ thống, phần mềm và công cụ dành cho nhà phát triển thành một nền tảng hoàn chỉnh.

Phía Arm cho biết, năng lực của AI tác tử đã tiến hóa từ tương tác hỏi đáp giai đoạn đầu sang giai đoạn hiểu ý định người dùng và tự thực thi tác vụ. Các luồng công việc của AI tác tử và công nghệ đồ họa AI nguyên bản ngày càng phức tạp đã đặt ra những yêu cầu mới cho tính toán di động. Hiệu năng của thiết bị di động sẽ phụ thuộc vào ba khía cạnh cốt lõi: tốc độ thực thi ở mỗi giai đoạn tác vụ, hiệu suất truyền tải dữ liệu giữa các công cụ tính toán khác nhau và khả năng điều phối hiệp đồng của hệ thống đối với toàn bộ quy trình tác vụ.
Dựa trên đó, CSS for Mobile 2 tối ưu hóa toàn diện hiệu năng, hiệu suất năng lượng và hiệu quả truyền tải dữ liệu từ cấp độ hệ thống, đồng thời mở rộng tối ưu hóa sang giai đoạn hiện thực hóa vật lý. Điều này cho phép các đối tác cân nhắc đồng thời công suất, hiệu năng và diện tích (PPA) với thiết kế kiến trúc ngay cả trước khi triển khai tích hợp SoC. Nền tảng này duy trì sự linh hoạt trong việc lựa chọn linh kiện, đối tác có thể chọn riêng lẻ từng thành phần hoặc kết hợp chúng với IP tự phát triển hoặc IP từ bên thứ ba.

Cụm CPU Arm C2: Động cơ SME2 kép
Về phần CPU, cụm CPU Arm C2 kết hợp giữa CPU C2-Ultra, CPU C2-Pro và công nghệ Arm Scalable Matrix Extension (SME2) thế hệ thứ hai. Dữ liệu chính thức công bố cho thấy hiệu năng của cụm này trên các mô hình AI mới nhất tăng tối đa 1,7 lần, hiệu năng đơn luồng tăng tối đa 15%, tốc độ duyệt web tăng 15%, tốc độ khởi chạy ứng dụng tăng 12%, hiệu năng đa luồng cấp cụm tăng 12%, hỗ trợ xử lý song song các tác vụ như truy xuất tri thức, chuẩn bị mô hình và thực thi ứng dụng.

So với cấu hình thế hệ trước, cụm CPU C2 thế hệ mới tích hợp động cơ SME2 kép, giúp năng lực SME2 tăng gấp đôi. Cụ thể đối với từng khâu trong luồng công việc của AI tác tử:
Khi chạy các mô hình chuyển đổi giọng nói thành văn bản mới nhất là Moonshine và Parakeet, C2-Ultra trang bị SME2 có độ trễ thấp hơn 40% so với C1-Ultra, giúp rút ngắn độ trễ khởi đầu của tương tác AI tác tử;
Trong giai đoạn ghi nhớ, hiệu suất truy xuất và tìm kiếm thông tin trong bộ nhớ tăng 41% so với thế hệ trước;
Trong giai đoạn suy luận, tốc độ trung bình để các mô hình ngôn ngữ nhỏ kết hợp với ngữ cảnh đã truy xuất để tạo ra các chỉ dẫn có cấu trúc tăng 25% so với thế hệ trước.

Trong các bài kiểm tra toàn diện (end-to-end) bao gồm các khâu xử lý giọng nói, truy xuất bộ nhớ, suy luận, thực thi ứng dụng và duyệt web, cấu hình C2-Ultra đạt mức tăng hiệu năng tổng thể 24% so với thế hệ trước.

Arm cũng giới thiệu lớp điều phối (Orchestration Layer) cốt lõi của luồng công việc này. Lớp này chịu trách nhiệm duy trì trạng thái tác vụ, tích hợp thông tin ngữ cảnh và quyết định tài nguyên tính toán nào sẽ thực thi từng giai đoạn trong luồng công việc. Quá trình thực thi có thể liên quan đến ứng dụng cục bộ, mô hình trên thiết bị (on-device), các tài nguyên tính toán khác hoặc dịch vụ đám mây, trong khi CPU đóng vai trò điều phối thống nhất việc quản lý quyền hạn và tiến trình thực thi tác vụ.

Mali G2-Ultra NX: Bộ tăng tốc mạng thần kinh tiến vào GPU
Về phần GPU, Mali G2-Ultra NX là GPU Mali AI-native đầu tiên của Arm. Thay đổi cốt lõi là việc nhúng trực tiếp bộ tăng tốc mạng thần kinh chuyên dụng vào nhân đổ bóng (shader core) của GPU, cho phép các khối lượng công việc đồ họa thần kinh chạy song song với các tác vụ đồ họa và tính toán, đồng thời tái sử dụng hệ thống bộ nhớ, bộ đệm nhất quán và cấu trúc điều khiển của GPU, giúp giảm thiểu việc truyền tải dữ liệu giữa các đơn vị tính toán khác nhau. GPU này kết hợp động cơ thực thi hoàn toàn mới và đơn vị dò tia thế hệ thứ ba (RTUv3), cung cấp nền tảng đồ họa AI-native cho các khối lượng công việc đồ họa thần kinh.
GPU này hỗ trợ ba công nghệ tăng tốc mạng thần kinh: Neural Super Sampling (NSS) giúp tái tạo hình ảnh độ phân giải cao hơn từ hình ảnh kết xuất độ phân giải thấp; Neural Frame Rate Up-scaling (NFRU) giúp tăng tốc độ khung hình bằng cách tạo ra các khung hình trung gian; và Neural Super Sampling & Denoising (NSSD) kết hợp siêu phân giải với khử nhiễu, hướng tới các cảnh dò tia phức tạp.
Trong trò chơi demo "Light & Shadow" do Arm và Sumo Digital hợp tác xây dựng dựa trên Unreal Engine, các giải pháp NFRU và NSSD đã đạt mức tăng hiệu suất lên tới 4 lần so với kết xuất truyền thống, lưu lượng bộ nhớ ngoài giảm tới 70%, cho phép các công nghệ như Unreal Engine MegaLights được áp dụng trên thiết bị di động. GPU này được thiết kế cho trải nghiệm tốc độ khung hình cao liên tục, hỗ trợ vận hành ổn định lên tới 120 khung hình/giây.
Động cơ thực thi là bản nâng cấp kiến trúc tập lệnh lớn nhất trong bảy thế hệ sản phẩm Mali của Arm, hỗ trợ số lượng thanh ghi trên mỗi nhóm luồng (warp) gấp 2 lần so với thế hệ trước và áp dụng cơ chế phân bổ thanh ghi động để giảm thiểu tình trạng tràn thanh ghi.
So với sản phẩm thế hệ trước, hiệu năng benchmark tăng tối đa 24%, hiệu năng chơi game không dùng AI tăng 14%. Về dò tia, kiến trúc mới có thể giảm lưu lượng DRAM tối đa 13% trong các bài kiểm tra dò tia phổ biến và cung cấp hỗ trợ cấp phần cứng cho Opacity Micro-Maps (OMM).
Dữ liệu demo của Arm cho thấy việc sử dụng OMM có thể giúp tăng tốc độ khung hình thêm 30% và giảm khối lượng công việc dò tia tới 70%. Để làm bối cảnh, tổng số lượng xuất xưởng của GPU Arm Mali đã vượt quá 14 tỷ đơn vị.
Hệ sinh thái phần mềm: KleidiAI và Arm AI Portal
Về phần mềm, CSS for Mobile 2 dựa vào cộng đồng hơn 22 triệu nhà phát triển Arm trên toàn cầu. Thông qua việc tích hợp sâu KleidiAI với các khung AI phổ biến, nền tảng cung cấp các đường dẫn thực thi phần mềm được tối ưu hóa cho CPU Arm, giúp nhà phát triển tận dụng các năng lực nền tảng như SME2 mà không cần thay đổi quy trình phát triển hiện tại.
Arm AI Portal tập hợp các mô hình đã được tối ưu hóa và kiểm chứng, dữ liệu về hiệu năng và độ chính xác, mã mẫu và tài nguyên triển khai trên một nền tảng thống nhất. Máy chủ Arm MCP đưa các năng lực này vào môi trường phát triển AI tác tử, giúp nhà phát triển đẩy nhanh quy trình từ đánh giá đến triển khai.
Theo thông tin do Arm công bố, CSS for Mobile 2 cung cấp một nền tảng cơ sở có thể cấu hình linh hoạt cho các đối tác chip. Mọi người có thể tiếp tục theo dõi tiến độ ứng dụng của nền tảng này trên các dòng chip thiết bị đầu cuối và sản phẩm hoàn chỉnh trong thời gian tới.
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.