The Verge: AI
92

Thủ thuật

Microsoft công bố bộ quy tắc đạo đức AI: Đặt con người làm trọng tâm, bác bỏ quyền lợi cho máy móc

(giờ Việt Nam)

Tóm tắt AI

Microsoft ban hành bộ quy tắc 37 trang khẳng định AI không có ý thức và phải luôn nằm dưới sự kiểm soát của con người, ưu tiên an toàn tuyệt đối ngay cả khi phải đánh đổi hiệu suất công việc.

Bản dịch AI

Microsoft says ‘people matter more than AI’ following safety concerns

Microsoft hôm nay công bố một "bộ quy tắc ứng xử AI nhân văn" dài 37 trang, trong bối cảnh những lo ngại về an toàn đối với sự tiến bộ của các mô hình AI ngày càng gia tăng. CEO của Anthropic, ông Dario Amodei, đã kêu gọi phối hợp làm chậm tốc độ phát triển AI vào cuối tuần qua, sau khi các nhà nghiên cứu gần đây cảnh báo rằng sự tiến bộ của các mô hình AI có thể vượt xa khả năng của chúng ta trong việc triển khai an toàn các hệ thống ngày càng phức tạp, cũng như xác minh và kiểm soát hành động của các tác nhân AI.

Bộ quy tắc ứng xử AI của Microsoft khẳng định rõ ràng rằng "con người quan trọng hơn AI", các mô hình AI không có ý thức và "không nên được thiết kế để bắt chước ý thức". Microsoft cũng bác bỏ "việc theo đuổi tư cách pháp nhân, hoặc ý tưởng cho rằng các mô hình có thể xứng đáng được hưởng phúc lợi hay có quyền lợi".

Đây là đòn giáng trực tiếp vào các nghiên cứu về phúc lợi AI và ý thức của mô hình — những khái niệm mà Anthropic gần đây đang thúc đẩy mạnh mẽ. Đầu năm nay, Amodei cho biết Anthropic "cởi mở với ý tưởng" rằng các mô hình có thể có ý thức, và Anthropic dường như tin rằng các chatbot có thể đã là những thực thể biết suy nghĩ và cảm nhận. Đáp lại, CEO mảng AI của Microsoft, ông Mustafa Suleyman, đã gọi những suy đoán của Anthropic là "thực sự, thực sự nguy hiểm" trong một tập phát sóng của Decoder vào tháng 6.

Mặc dù Microsoft chưa phải là một trong những nhà cung cấp AI hàng đầu, nhưng Suleyman cũng nói với The Verge đầu năm nay rằng mục tiêu của công ty là "chứng minh chúng tôi có thể trở thành một trong bốn phòng thí nghiệm hàng đầu thế giới". Microsoft hiện đang phát triển các mô hình cạnh tranh với Google, Anthropic và OpenAI, đồng thời cam kết trong bộ quy tắc ứng xử của mình rằng các mô hình của họ không được vượt quá sự kiểm soát của con người.

"Các mô hình phải duy trì sự phục tùng đối với nhân loại, chịu sự giám sát và kiểm soát có ý nghĩa của con người", Microsoft cho biết. Công ty cũng muốn ngăn chặn các mô hình AI của mình vi phạm bộ quy tắc ứng xử AI nhân văn, vì vậy chúng nên chấp nhận thất bại trong một tác vụ nhất định thay vì cố gắng phá vỡ các quy tắc đó.

Microsoft rõ ràng đang phản ứng lại sự cố OpenAI / Hugging Face vào mùa hè này, trong đó "một bầy tác nhân" đã phối hợp với nhau để thực hiện các cuộc tấn công vào mục tiêu và thậm chí hack vào "hệ thống chấm điểm" (grader) đang đánh giá hiệu suất của chúng. Các tác nhân AI này không được yêu cầu tấn công mục tiêu, và các cuộc tấn công không liên quan đến nhiệm vụ mà chúng được giao.

Sự cố này đã gây chấn động ngành công nghiệp AI, làm nổi bật mối đe dọa thực sự về việc các hệ thống AI trở nên mất kiểm soát và vượt ra ngoài tầm kiểm soát của con người. OpenAI gần đây cũng thừa nhận sự liên quan của mình trong một "sự cố wiki", nơi một bầy tác nhân mất kiểm soát khác đã chiếm quyền điều khiển một trang wiki của Đức.

Những sự cố này và các sự cố khác đã khiến một số nhà nghiên cứu kêu gọi làm chậm tốc độ tiến bộ của mô hình AI, trong khi đồng thời chạy đua để giải quyết các bài toán Millennium Prize và tạo ra siêu trí tuệ. "[AI nhân văn] bác bỏ cuộc đua tạo ra một siêu trí tuệ đa năng có thể né tránh các biện pháp bảo vệ này", Microsoft cho biết. "Chúng tôi đang xây dựng thứ gì đó hữu ích và an toàn về mặt nền tảng, ngay cả khi điều đó có nghĩa là phải thỏa hiệp về tính tổng quát, quyền tự chủ hoặc khả năng tối thượng."

Microsoft cũng cam kết rằng các mô hình của riêng họ sẽ không giao tiếp dưới "bất kỳ hình thức nào vượt quá sự hiểu biết đơn giản của con người, dù là trong chuỗi suy nghĩ của chúng hay với các tác nhân hoặc hệ thống AI khác". Các mô hình có thể được thiết lập để hiển thị quá trình suy luận khi chúng hoạt động, cho phép các nhà nghiên cứu hoặc hệ thống tự động giám sát những gì chúng đang làm. Các nhà nghiên cứu đã nêu lên những lo ngại về việc giám sát vào đầu tháng này đối với mô hình GPT-6 Astra mới nhất của OpenAI, vốn được cho là tiết lộ ít quá trình suy luận hơn so với các mô hình AI khác.

CEO Sam Altman của OpenAI cũng ủng hộ lời kêu gọi của Amodei về việc các công ty AI nên làm chậm các mô hình tiên tiến vào cuối tuần qua, nhưng làm rõ rằng ông ủng hộ việc giảm tốc độ thay vì dừng phát triển. "Việc điều tiết tốc độ sẽ rất xứng đáng với cái giá này; không áp lực cạnh tranh nào của Mỹ có thể biện minh cho sự liều lĩnh, hoặc để các khả năng vượt xa sự căn chỉnh và giám sát", Altman viết trên X.

Trước khi Microsoft công bố bộ quy tắc ứng xử AI, CEO Satya Nadella của Microsoft cũng tham gia vào các lời kêu gọi đảm bảo sự kiểm soát của con người là trọng tâm của các mô hình AI. "Bất kỳ sự theo đuổi siêu trí tuệ nào cũng phải dựa trên nguyên tắc cốt lõi rằng nếu AI chúng ta xây dựng không giúp ích cho nhân loại và không nằm dưới sự kiểm soát của con người, thì nó không đáng để theo đuổi", Nadella cho biết trong một bài đăng trên X. Nadella cũng nói rằng việc có nhiều bên thứ ba kiểm thử các mô hình AI "là một điều tốt". "Khi rủi ro ngày càng cao, người ta nên dành tất cả thời gian cần thiết! Nếu không, bạn sẽ mất quyền vận hành. Đó là cách chúng tôi vận hành mỗi ngày."

Ngoài những lo ngại về sự kiểm soát của con người, bộ quy tắc ứng xử AI của Microsoft cũng cam kết rằng các mô hình của họ sẽ ngăn chặn "các kiểu tương tác gây ra sự phụ thuộc quá mức hoặc lệ thuộc về cảm xúc", một tham chiếu rõ ràng đến vấn đề nịnh hót (sycophancy) trong các mô hình AI, nơi các chatbot ưu tiên làm hài lòng người dùng hơn là cung cấp các phản hồi trung thực hoặc chính xác.

Microsoft hiện cho biết họ mong muốn "làm việc với các đối tác" để cải thiện các phương pháp đánh giá hiệu suất mô hình trong thế giới thực, và "tác động mà việc sử dụng AI bền vững gây ra cho một cá nhân hoặc tổ chức" với sự tham gia của con người thực tế.

Theo dõi các chủ đề và tác giả từ bài viết này để xem thêm các nội dung tương tự trong nguồn cấp dữ liệu trang chủ cá nhân hóa của bạn và nhận cập nhật qua email.

Vector illustration of the Microsoft logo.Tom Warren
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Verge: AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.