QbitAI
Điểm AI 75/100

Sản phẩm

Phòng thí nghiệm AI An toàn Trường Giang ra mắt bộ ba giải pháp bảo mật AI: Tinh Giới, Tinh Ngự, Tinh Giám

(giờ Việt Nam)

Tóm tắt AI

Tại Hội nghị An ninh mạng Trung Quốc (CCSC 2026) diễn ra ở Hợp Phì, Phòng thí nghiệm AI An toàn Trường Giang đã giới thiệu ba giải pháp bảo mật AI đột phá nhằm tăng cường an ninh cho hệ thống trí tuệ nhân tạo.

Chính văn · Bản dịch AI

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

21/09/2026 15:52:46 Nguồn: QbitAI

Ngày 19 tháng 9, các diễn đàn chuyên đề cấp cao thuộc Hội nghị An ninh Không gian mạng Trung Quốc lần thứ nhất (CCSC 2026) đã chính thức diễn ra tại Hợp Phì, An Huy.

Ngày 19 tháng 9, diễn đàn chuyên đề cấp cao về An ninh AI và Quản trị Ứng dụng thuộc Hội nghị An ninh Không gian mạng Trung Quốc lần thứ nhất (CCSC 2026) đã chính thức diễn ra tại Hợp Phì, An Huy. Với tư cách là một trong những đơn vị đăng cai, Phòng thí nghiệm Trí tuệ nhân tạo An toàn vùng Đồng bằng sông Trường Giang tỉnh An Huy đã công bố ba giải pháp an ninh AI lớn tại sự kiện, bao gồm: Xingjie, Xingyu và Xingjian. Các giải pháp này bao phủ các khía cạnh về an ninh nội dung mô hình lớn, an ninh ứng dụng tác nhân thông minh (AI agent) và tính tin cậy trong lan truyền nội dung do AIGC tạo ra. Giám đốc phòng thí nghiệm, ông Lưu Tuấn Hoa, đã có bài phát biểu chủ đề "Tiến bộ công nghệ và thực tiễn ứng dụng trong quản trị an ninh AI", chia sẻ về những tiến bộ kỹ thuật mới nhất và thực tiễn công nghiệp của phòng thí nghiệm trong lĩnh vực an ninh AI.

Ra mắt ba giải pháp lớn, xây dựng năng lực quản trị an ninh AI toàn trình

Hiện nay, sự nhảy vọt của công nghệ AI và việc mở rộng các ứng dụng công nghiệp đang tăng tốc, kéo theo đó là các vấn đề an ninh ngày càng nghiêm trọng, gây ảnh hưởng và hạn chế sự phát triển hơn nữa của AI.

Là nền tảng đổi mới khoa học công nghệ cấp cao được Chính phủ tỉnh An Huy phê duyệt và dựa trên sự hỗ trợ của Công ty TNHH Công nghệ Thông minh An Huy Xingdun, Phòng thí nghiệm Trí tuệ nhân tạo An toàn vùng Đồng bằng sông Trường Giang cam kết xây dựng năng lực quản trị và bảo vệ an ninh AI, hộ tống sự phát triển của công nghệ và ngành công nghiệp AI. Phòng thí nghiệm đã đạt được nhiều giải thưởng, chứng nhận uy tín và giành quán quân tại các cuộc thi đánh giá trong lĩnh vực an ninh AI. Tập trung vào các thách thức then chốt trong quản trị an ninh AI, phòng thí nghiệm liên tục xây dựng và hoàn thiện hệ thống sản phẩm quản trị và bảo vệ an ninh AI.

Tại diễn đàn, Viện sĩ Viện Hàn lâm Kỹ thuật Trung Quốc Ngô Thế Trung; đồng sáng lập kiêm Giám đốc Ủy ban Kỹ thuật của iFLYTEK, Hồ Quốc Bình; Giáo sư Đại học Khoa học và Công nghệ Trung Quốc kiêm Nhà khoa học trưởng của Phòng thí nghiệm Trí tuệ nhân tạo An toàn vùng Đồng bằng sông Trường Giang, Du Năng Hải; và Giám đốc phòng thí nghiệm Lưu Tuấn Hoa đã cùng lên sân khấu, chính thức công bố ba giải pháp quản trị an ninh AI: Giải pháp quản trị an ninh nội dung mô hình lớn "Xingjie", giải pháp an ninh ứng dụng tác nhân thông minh "Xingyu" và giải pháp quản trị lan truyền nội dung tin cậy AIGC "Xingjian".

Xingjie hướng tới toàn bộ vòng đời của mô hình lớn, cung cấp năng lực quản trị nội dung an toàn tích hợp bao phủ từ xây dựng dữ liệu, huấn luyện mô hình, triển khai ứng dụng đến vận hành liên tục. Từ nguồn gốc, giải pháp giúp giảm thiểu rủi ro nội sinh thông qua làm sạch dữ liệu huấn luyện, căn chỉnh giá trị an toàn và tăng cường an ninh mô hình; trong quá trình vận hành ứng dụng, thông qua các rào chắn an ninh nội dung, giải pháp nhận diện và xử lý thời gian thực các rủi ro như tấn công bằng câu lệnh (prompt attack), nội dung vi phạm pháp luật; trong quá trình vận hành liên tục, thông qua giám sát rủi ro và đánh giá thủ công để phát hiện vấn đề, can thiệp nhanh chóng và tối ưu hóa khép kín. Đồng thời, việc đánh giá an ninh được xuyên suốt toàn bộ quá trình để liên tục kiểm chứng và thúc đẩy nâng cao năng lực an toàn.

Xingjie có thể áp dụng cho các ứng dụng mô hình lớn trong các ngành như giáo dục, y tế, ô tô, bao phủ từ khâu nghiên cứu phát triển mô hình, đánh giá khi triển khai, bảo vệ vận hành đến vận hành liên tục; hỗ trợ cả mô hình mã nguồn mở và mã nguồn đóng, tương thích với triển khai trên đám mây và triển khai riêng tư, đáp ứng các nhu cầu quản trị nội dung an toàn khác biệt.

Xingyu hướng tới các loại ứng dụng tác nhân thông minh (AI agent), xây dựng giải pháp quản trị an ninh tích hợp tấn công và phòng thủ bao phủ toàn bộ vòng đời. Giải pháp lấy quản lý danh tính và quyền hạn làm nền tảng, có thể xác định rõ chủ thể thực thi, quan hệ ủy quyền và ranh giới thao tác của tác nhân; trước khi triển khai, thông qua kiểm tra an ninh Skill để nhận diện rủi ro chuỗi cung ứng, đồng thời xác thực rủi ro thực thi thông qua kiểm thử Red Team tự động trong trường bắn an ninh; trong quá trình vận hành, giải pháp bao phủ toàn bộ quy trình "Nhập liệu - Lập kế hoạch - Thực thi", giám sát và xử lý phân cấp các rủi ro như tiêm câu lệnh (prompt injection), lạm dụng công cụ, thao tác vượt quyền, rò rỉ thông tin nhạy cảm và mất kiểm soát tác vụ; sau sự cố, thông qua phát lại nhật ký và kiểm toán toàn trình để hỗ trợ truy xuất nguồn gốc, đảm bảo tác nhân vận hành an toàn đồng thời đảm bảo tính khả dụng của nghiệp vụ.

Xingyu có thể áp dụng trong các kịch bản ứng dụng tác nhân thông minh như văn phòng thông minh, tài chính và chính phủ điện tử, cung cấp bảo đảm an ninh xoay quanh việc chống rò rỉ dữ liệu, kiểm soát quyền hạn, gọi công cụ và kiểm toán hành vi; đồng thời hỗ trợ xét duyệt gia nhập thị trường Skill, quản trị kho Skill doanh nghiệp và tự kiểm tra an ninh trong giai đoạn phát triển.

Xingjian hướng tới việc lan truyền và quản trị nội dung AIGC, xây dựng giải pháp quản trị lan truyền tin cậy tích hợp bao phủ bốn phương thức: văn bản, hình ảnh, âm thanh và video. Thông qua định danh nội dung và hình mờ kỹ thuật số (digital watermark), giải pháp thiết lập danh tính kỹ thuật số có thể xác thực cho nội dung AI; đối với nội dung không rõ nguồn gốc, kết hợp với nhận diện nội dung do AI tạo ra và nhận diện nội dung độc hại để phát hiện nội dung do AI tạo ra và deepfake, đánh giá rủi ro vi phạm nội dung, kết nối việc định danh nội dung, kiểm tra xác thực và truy xuất nguồn gốc, từ đó nâng cao độ tin cậy và khả năng truy xuất của nội dung lan truyền.

Xingjian có thể được sử dụng trong các kịch bản như sáng tạo AIGC, nền tảng nội dung, truyền thông tin tức và lan truyền xã hội, hỗ trợ định danh nội dung AI, phát hiện nội dung tạo ra và deepfake, nhận diện nội dung độc hại và truy xuất nguồn gốc, đồng thời cung cấp cơ sở kỹ thuật cho việc bảo vệ bản quyền và xác thực nguồn gốc.

Quản trị an ninh AI mở ra cơ hội công nghiệp mới, cần sự chung tay của các bên

Tại hiện trường, Giám đốc Phòng thí nghiệm Trí tuệ nhân tạo An toàn vùng Đồng bằng sông Trường Giang, ông Lưu Tuấn Hoa, cũng đã có bài thuyết trình với tiêu đề "Tiến bộ công nghệ và thực tiễn ứng dụng trong quản trị an ninh AI", chia sẻ về những tiến bộ mới nhất của các công nghệ cốt lõi trong quản trị an ninh AI và kết quả thực tiễn ứng dụng công nghiệp.

Ông Lưu Tuấn Hoa cho biết, về an ninh nội sinh, phòng thí nghiệm xây dựng hệ thống căn chỉnh giá trị mô hình lớn từ nguồn dữ liệu, đồng thời liên tục xây dựng và hoàn thiện hệ thống đánh giá, thiết lập nền tảng đánh giá an ninh một cửa, đồng thời xây dựng hệ thống bảo vệ an ninh cho nội dung mô hình lớn và an ninh tác nhân, củng cố tuyến phòng thủ cuối cùng cho vận hành kiểm soát rủi ro. Trong quản trị lan truyền, phòng thí nghiệm thực hiện song song cả việc nhúng định danh và nhận diện để phòng ngừa việc lạm dụng bất hợp pháp AIGC.

Việc ứng dụng công nghệ AI quy mô lớn trong các ngành công nghiệp đã cung cấp nhu cầu thiết yếu và mảnh đất màu mỡ cho quản trị an ninh AI. Sự tích lũy kỹ thuật và các sản phẩm cốt lõi của Phòng thí nghiệm Trí tuệ nhân tạo An toàn vùng Đồng bằng sông Trường Giang đã được kiểm chứng hiệu quả trong thực tiễn ứng dụng: Từ năm 2023, phòng thí nghiệm liên tục nâng cấp các giải pháp bảo vệ cho mô hình lớn iFLYTEK Spark, xây dựng chiến lược ngành, thực hiện bảo vệ an ninh "phân cấp phân loại". Nền tảng bảo vệ an ninh mô hình lớn hỗ trợ kết nối nhiều mô hình lớn mã nguồn mở và mô hình lớn của các doanh nghiệp trung ương/nhà nước, năm 2025 đã triển khai 25 dự án riêng tư, năm 2026 số lượt gọi trung bình hàng ngày vượt quá hàng trăm triệu; thúc đẩy các nền tảng sản phẩm liên quan đến quét Skill tác nhân, hộ tống an ninh nghiệp vụ; tích cực thúc đẩy hình mờ ẩn và nhận diện nội dung AIGC, xây dựng nền tảng xử lý và nhận diện nội dung AIGC đầu tiên của Bộ Công nghiệp và Công nghệ thông tin.

"Quản trị an ninh AI cũng mở ra cơ hội hoàn toàn mới cho ngành, đây là một thị trường có nhu cầu thiết yếu về kịch bản và đang tăng trưởng nhanh chóng". Ông Lưu Tuấn Hoa cho rằng, dưới những cơ hội đó, vẫn cần chú ý đến các rủi ro an ninh AI đang biến đổi năng động, cần sự tham gia chung tay của các bên, kiên trì mở cửa mã nguồn, tăng cường xây dựng tổng thể hệ sinh thái quản trị an ninh AI để hộ tống tốt hơn sự phát triển của ngành.

Từ mô hình lớn đến tác nhân thông minh, từ tạo nội dung đến lan truyền nội dung, an ninh AI đang trở thành một trong những năng lực nền tảng quan trọng cho việc ứng dụng AI quy mô lớn. Việc công bố tập trung ba giải pháp an ninh AI lần này là một bước quan trọng của Phòng thí nghiệm Trí tuệ nhân tạo An toàn vùng Đồng bằng sông Trường Giang trong việc thúc đẩy thương mại hóa công nghệ và sản phẩm. Trong tương lai, phòng thí nghiệm sẽ tiếp tục hướng tới các công nghệ mới, kịch bản mới và rủi ro mới trong sự phát triển của AI, làm sâu sắc thêm sự đổi mới công nghệ then chốt, thúc đẩy sự kết hợp chặt chẽ giữa năng lực an ninh AI và ứng dụng công nghiệp, bằng năng lực quản trị an ninh có hệ thống hơn, thông minh hơn và dễ triển khai hơn, nhằm củng cố nền tảng an ninh cho sự phát triển của ngành công nghiệp trí tuệ nhân tạo.

Bài viết này do iFLYTEK cung cấp, QbitAI được ủy quyền đăng tải lại, quan điểm thuộc về tác giả gốc.

Bản quyền thuộc về đơn vị sở hữu, không được phép đăng tải lại hoặc sử dụng dưới bất kỳ hình thức nào khi chưa được ủy quyền, người vi phạm sẽ bị xử lý theo pháp luật.

Bảo mật AIAn ninh mạngCCSC 2026Giải pháp AI

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Phòng thí nghiệm AI An toàn Trường Giang ra mắt bộ ba giải pháp bảo mật AI: Tinh Giới, Tinh Ngự, Tinh Giám | AIHOT.vn