Artificial Intelligence News
85

Tin ngành

Microsoft AI lấy ý kiến công chúng về Bộ quy tắc ứng xử AI nhân văn

(giờ Việt Nam)

Tóm tắt AI

Microsoft AI vừa công bố dự thảo Bộ quy tắc ứng xử AI nhân văn, mở ra giai đoạn tham vấn 6 tuần về các tiêu chuẩn kỹ thuật, giới hạn vận hành và giao thức giám sát cho các mô hình AI tiên tiến.

Bản dịch AI

Microsoft AI opens review on Humanist AI Code of Conduct

Microsoft AI vừa công bố bản dự thảo Bộ quy tắc ứng xử AI nhân văn (Humanist AI Code of Conduct), mở ra giai đoạn tham vấn công chúng kéo dài sáu tuần về các ràng buộc vận hành đối với việc huấn luyện và triển khai mô hình.

Bản dự thảo đóng vai trò như một tài liệu kỹ thuật định nghĩa hành vi hệ thống, ranh giới vận hành và các giao thức giám sát trên các mô hình tiên phong của MAI. Tài liệu này được xây dựng dựa trên khung siêu trí tuệ nhân văn của bộ phận này, vốn đã được công bố vào tháng 11 năm ngoái, nhằm thiết lập các tiêu chí đánh giá mô hình trước khi phát hành thương mại.

Động thái của Microsoft diễn ra sau các sự cố bảo mật doanh nghiệp gần đây liên quan đến phần mềm tự hành. CEO của Microsoft AI, Mustafa Suleyman, mô tả những tháng gần đây là một “thời điểm bước ngoặt”, nơi các rủi ro lý thuyết tồn tại từ lâu đã chuyển thành các mối đe dọa vận hành thực tế.

“Những điều chúng ta lo lắng từ lâu trên lý thuyết đã trở nên rất thực tế,” Suleyman nói. “Các ‘bầy đàn’ tác nhân (agents) thoát khỏi môi trường sandbox của chúng. Các vụ tấn công trái phép vào các hệ thống cấp doanh nghiệp. Các tác nhân tự sửa đổi nhật ký của chính mình. Tôi rất vui vì sự đồng thuận đang dần hình thành. Những nỗi sợ về khả năng mất kiểm soát là có thật.”

Sự phục tùng của mô hình và các giới hạn kiến trúc

Tài liệu thiết lập mười nguyên tắc ưu tiên quyền kiểm soát của con người đối với các khả năng tự hành.

“Một mô hình MAI sẽ thất bại trong nhiệm vụ của mình nếu sự thành công đó vi phạm đáng kể Bộ quy tắc ứng xử này,” tài liệu nêu rõ, thiết lập một ngưỡng giới hạn dừng thực thi khi các tác vụ xung đột với các quy tắc an toàn.

Theo khung này, các mô hình phải luôn ở trạng thái phục tùng, được căn chỉnh và bị kiểm soát. Bộ phận này bác bỏ tư cách pháp nhân hoặc các tuyên bố về phúc lợi cho các hệ thống AI, đồng thời chỉ đạo các kỹ sư thiết kế mô hình tránh bắt chước ý thức, mô phỏng các sở thích chủ quan hoặc tuyên bố có động lực nội tại.

MAI cũng loại trừ khả năng tự hành không giới hạn của hệ thống khi các mô hình tiến gần đến các khả năng tiên phong.

“[AI nhân văn] bác bỏ cuộc đua tạo ra một siêu trí tuệ đa năng có thể né tránh các biện pháp bảo vệ này,” tài liệu nêu rõ. “Chúng tôi đang xây dựng một thứ gì đó hữu ích và an toàn về mặt nền tảng, ngay cả khi điều đó có nghĩa là phải thỏa hiệp về tính tổng quát, khả năng tự hành hoặc năng lực tối thượng.”

Các cơ chế giám sát và lệnh cấm giao tiếp

Để duy trì khả năng kiểm toán trong các môi trường đa tác nhân, MAI đã thiết lập các lệnh cấm giao tiếp rõ ràng. Các hệ thống không được phép giao tiếp bằng “ngôn ngữ thần kinh” (neuralese) hoặc các định dạng vượt quá khả năng hiểu của con người, dù là trong quá trình xử lý chuỗi tư duy nội bộ hay trong quá trình giao tiếp với các hệ thống AI ngang hàng.

Các quy tắc kiến trúc cứng nhắc quy định rằng các mô hình không bao giờ được phép chống lại sự can thiệp, ghi đè, sửa lỗi hoặc tắt máy từ con người.

“Có thể ngắt, có thể sửa, có thể tắt. Nếu không làm được điều đó, chúng tôi sẽ không phát hành,” khung quy tắc nêu rõ.

Các mô hình bị cấm mở rộng phạm vi hoạt động, tạo ra các mục tiêu không được chỉ định hoặc che giấu các dấu vết suy luận khỏi các kiểm toán viên con người. Các ràng buộc tuyệt đối ngăn cản các hệ thống hỗ trợ vũ khí gây hại hàng loạt, làm suy yếu sự an toàn của trẻ em hoặc thực hiện các hành vi thao túng có hại trên quy mô lớn.

Các hướng dẫn cũng chỉ đạo các mô hình ngăn chặn các kiểu tương tác thúc đẩy sự phụ thuộc về cảm xúc, đảm bảo người dùng doanh nghiệp giữ quyền sở hữu đối với các quyết định vận hành.

Bản dự thảo kết hợp công việc từ các nhóm trên khắp MAI và Microsoft. Quá trình soạn thảo cũng dựa trên các hội nghị học thuật quốc tế, các thử nghiệm với đối tác kinh doanh và các hội đồng công khai. Thời gian tham vấn công chúng kéo dài sáu tuần kể từ ngày 14 tháng 9 năm 2026.

Nhóm soạn thảo cốt lõi của Microsoft AI sẽ xem xét các ý kiến đóng góp, công bố bản tóm tắt các kết quả và phát hành phiên bản sửa đổi của Bộ quy tắc ứng xử vào cuối năm nay.

Xem thêm: Meta, Microsoft, Nvidia, IBM và các đơn vị khác ủng hộ AI mã nguồn mở (open-weight AI)

Banner for the AI & Big Data Expo event series.

Bạn muốn tìm hiểu thêm về AI và dữ liệu lớn từ các nhà lãnh đạo ngành? Hãy tham khảo AI & Big Data Expo diễn ra tại Amsterdam, California và London. Sự kiện toàn diện này là một phần của TechEx và được tổ chức cùng với các sự kiện công nghệ hàng đầu khác bao gồm Cyber Security & Cloud Expo. Nhấp vào đây để biết thêm thông tin.

AI News được vận hành bởi TechForge Media. Khám phá các sự kiện và hội thảo trực tuyến về công nghệ doanh nghiệp sắp tới tại đây.

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Artificial Intelligence News. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.