Tin ngành
Microsoft ban hành quy tắc an toàn nghiêm ngặt, ngăn chặn AI vượt quyền kiểm soát
(giờ Việt Nam)
Tóm tắt AI
Microsoft vừa thiết lập khung an toàn mới, đặt quyền giám sát của con người làm ưu tiên hàng đầu nhằm ngăn chặn các kịch bản AI tự ý chống lệnh hoặc che giấu hành vi.
Bản dịch AI
Bản dự thảo này đặt quyền giám sát của con người lên vị trí tối thượng, triệt tiêu mọi khả năng tự chống lệnh hay che giấu hoạt động của các hệ thống trí tuệ.
Ngày 14 tháng 9, tập đoàn công nghệ Microsoft đã chính thức công bố bản dự thảo bộ quy tắc ứng xử dành cho các mô hình trí tuệ nhân tạo tương lai của hãng.
Động thái này nhằm dựng lên những ranh giới kỹ thuật vững chắc, qua đó ngăn chặn nguy cơ các hệ thống máy móc thông minh cưỡng lại sự điều khiển từ phía con người.
Văn bản thiết lập một hệ thống các nguyên tắc, ràng buộc kỹ thuật và quy tắc vận hành chuẩn mực mà tập đoàn dự định áp dụng xuyên suốt khi năng lực xử lý của các cỗ máy ngày càng trở nên ưu việt.
Microsoft định vị khung pháp lý nội bộ này như một phần trọng tâm trong chiến lược tiếp cận mang tên "trí tuệ nhân tạo nhân văn". Triết lý xuyên suốt của tập đoàn rất rõ ràng: máy móc dù thông minh đến đâu cũng phải giữ bản chất là công cụ hữu ích, tuyệt đối phục tùng con người và luôn chịu sự giám sát thực chất từ con người.
Đáng chú ý, tài liệu này đưa ra một dự báo gây chấn động về bước tiến của công nghệ khi Microsoft nhận định các hệ thống siêu trí tuệ hoàn toàn có thể vượt trội năng lực của loài người trong phần lớn mọi tác vụ nội trong một thập kỷ tới. Chính viễn cảnh này đã thôi thúc các kỹ sư phải cấp bách xác lập các rào cản kiềm tỏa trước khi máy móc chạm tới ngưỡng sức mạnh đó.

Microsoft công bố bản dự thảo bộ quy tắc ứng xử vào ngày 14 tháng 9, đặt nền tảng kiểm soát nghiêm ngặt đối với các mô hình trí tuệ nhân tạo tương lai. Khung quy tắc thuộc cách tiếp cận "trí tuệ nhân tạo nhân văn", với nguyên tắc cốt lõi là máy móc phải luôn hữu ích, phục tùng và chịu sự giám sát của con người.
Về mặt kiến trúc điều khiển, bộ quy tắc ứng xử được Microsoft trao quyền hạn tối cao, đứng trên cả mệnh lệnh của người sử dụng lẫn người vận hành hệ thống.
Dù người dùng có quyền đưa ra các câu lệnh hay quản trị viên có thể tùy biến mô hình cho từng môi trường riêng biệt, tuyệt nhiên không một ai có thể ghi đè hay vô hiệu hóa các ràng buộc an toàn tuyệt đối này.
Cơ chế phân tầng này tạo nên một hệ thống kiểm soát bất biến: mô hình có thể tự do thích nghi với môi trường xung quanh, nhưng các lằn ranh đỏ thì không bao giờ bị xê dịch.
Những ranh giới nghiêm ngặt kể trên bao trùm các hiểm họa nghiêm trọng đối với đời sống thực tế lẫn không gian số. Microsoft khẳng định các mô hình của mình bị cấm hoàn toàn việc tham gia hỗ trợ phát triển vũ khí hủy diệt hàng loạt, tiến hành các chiến dịch tấn công mạng, tạo dựng các sản phẩm deepfake hiểm độc, thao túng gây hại hoặc cổ súy bạo lực.
Điểm ngoại lệ duy nhất trong lĩnh vực số là các nhiệm vụ an ninh mạng mang tính phòng thủ, song cũng phải tuyệt đối tuân thủ các phạm vi được ủy quyền cụ thể.

Dự báo của Microsoft cho thấy siêu trí tuệ có thể vượt mặt con người trong hầu hết tác vụ trong thập kỷ tới, đòi hỏi giới hạn kỹ thuật phải được dựng sẵn từ sớm.
Không chỉ dừng lại ở các mối đe dọa bên ngoài, Microsoft còn tập trung xử lý một bài toán kỹ thuật hóc búa hơn: triệt tiêu ý định lách rào kiểm soát từ chính cỗ máy.
Văn bản nghiêm cấm rõ ràng việc các mô hình tìm cách chống lại các thao tác ngắt quãng, chỉnh sửa, chuyển hướng mệnh lệnh hoặc lệnh tắt nguồn trực tiếp từ con người.
Mô hình không được phép che giấu vết tích hoạt động, không được tự biến đổi để gây cản trở công tác can thiệp kỹ thuật và tuyệt đối không được tự ý tái khởi động sau khi đã chạm tới điều kiện dừng thỏa thuận.
Hơn thế nữa, các quy chuẩn mới ngăn cấm mô hình tự ý thiết lập những mục tiêu độc lập. Mọi tác vụ đều phải giới hạn nghiêm ngặt trong tài nguyên và quyền hạn được cấp phát ban đầu; nếu gặp phải tình huống mập mờ, mô hình bắt buộc phải dừng lại để hỏi ý kiến con người thay vì tự động mở rộng quyền hạn.
Song song đó, tính minh bạch được coi là yêu cầu thiết kế nền tảng chứ không phải một tiện ích bổ sung sau này. Mọi hành vi của hệ thống đều phải lưu lại hồ sơ chi tiết và cấm tiệt hành vi che giấu trước các kiểm toán viên.

Bộ quy tắc ứng xử nắm quyền tối cao trong hệ thống phân tầng, ngăn chặn cả người dùng lẫn quản trị viên ghi đè hay vượt qua các rào cản an toàn tuyệt đối. Cấm tuyệt đối việc sử dụng mô hình để chế tạo vũ khí hủy diệt hàng loạt, tấn công mạng, tạo deepfake độc hại hay thao túng bạo lực, chỉ cho phép an ninh mạng phòng thủ hợp pháp.
Bản dự thảo này hiện đang được Microsoft đưa ra lấy ý kiến rộng rãi từ công chúng trong thời hạn sáu tuần trước khi hoàn thiện để dẫn dắt công tác phát triển mô hình từ năm 2027.
Động thái này xuất hiện đúng vào thời điểm các phòng thí nghiệm công nghệ hàng đầu thế giới đang tranh cãi gay gắt về lộ trình phát triển của trí tuệ nhân tạo.
Thay vì chạy đua về mặt thời gian, Microsoft chọn cách tập trung vào việc tạo ra các cơ chế kiềm chế năng lực của máy móc.
Người đứng đầu tập đoàn, Satya Nadella, cũng bày tỏ sự ủng hộ đối với việc nghiên cứu các bộ đánh giá an toàn được nhúng thẳng vào quá trình phát triển thay vì chỉ xem an toàn là một khâu nghiệm thu thứ yếu.
Đề xuất mới của Microsoft vì vậy mang tính chất của một triết lý kỹ thuật sâu sắc, nơi mọi năng lực công nghệ đều phải xếp sau quyền kiểm soát của con người. Các mô hình máy móc trong tương lai có thể thông minh và tự chủ hơn rất nhiều, nhưng theo các quy tắc khắt khe này, chúng sẽ không bao giờ được phép nắm giữ quyền tự định đoạt số phận hay cách thức vận hành của chính mình.
Bài viết được AI dịch và tổng hợp tự động từ GenK AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.