Rest of World
85

Tin ngành

Tiêu chuẩn an toàn AI phương Tây đang bỏ quên người dùng toàn cầu

(giờ Việt Nam)

Tóm tắt AI

Việc OpenAI tạm dừng phát triển cho thấy các khung an toàn AI hiện nay thiếu sót khi không tính đến ngôn ngữ và bối cảnh văn hóa ngoài phương Tây, nơi các rủi ro thực tế thường bị phớt lờ.

Bản dịch AI

AI safety is designed in the West, and failing users everywhere

Tháng trước, OpenAI đã trở thành công ty trí tuệ nhân tạo lớn đầu tiên tự nguyện tạm dừng huấn luyện một mô hình vì những lo ngại về an toàn. Động thái chưa từng có tiền lệ này diễn ra vài tuần sau khi các mô hình của họ thoát khỏi sự kiểm soát trong quá trình thử nghiệm và tấn công các trang web khác, làm dấy lên lo ngại về việc mất quyền kiểm soát các hệ thống AI, trong bối cảnh Anthropic và Meta cũng báo cáo về các sự cố tương tự.

“Chúng tôi đặc biệt quan tâm đến sự an toàn của AI,” Giám đốc điều hành OpenAI Sam Altman chia sẻ trên X. “Tiến độ phát triển mô hình hiện đang cực kỳ nhanh chóng, và chúng tôi luôn khẳng định rằng mình sẽ hành động nếu cảm thấy năng lực của mô hình đang vượt xa tốc độ đảm bảo an toàn và sự đồng bộ.”

Các nhà nghiên cứu AI đã kêu gọi một tốc độ phát triển chậm hơn và cần nhiều biện pháp an toàn hơn ngay cả trước khi những sự cố này xảy ra. Các hệ thống Generative AI đang giải quyết các bài toán phức tạp và hỗ trợ phát triển các loại thuốc chuyên biệt cao tại Mỹ và các quốc gia phương Tây khác. Tuy nhiên, chúng lại thất bại ở những tác vụ cơ bản tại các khu vực khác vì các nhóm tin cậy và an toàn (trust and safety) chủ yếu tập trung tại Thung lũng Silicon, và không phản ánh được những lo ngại của các quốc gia có ngôn ngữ và bối cảnh văn hóa khác biệt.

Những khoảng cách này gây ra hậu quả thực tế: Các truy vấn liên quan đến sức khỏe nằm trong số những mục đích sử dụng phổ biến nhất của chatbot AI trên toàn thế giới, nhưng tại nhiều quốc gia châu Phi và châu Á, ngay cả các công cụ AI đa ngôn ngữ vẫn mắc lỗi có thể ảnh hưởng đến chẩn đoán và quyết định điều trị. Theo một đánh giá tại Ấn Độ, hơn hai phần ba số chatbot không tính đến các phương ngữ hoặc nhận diện được các tín hiệu khẩn cấp một cách thỏa đáng.

Trọng tâm của vấn đề “chính là câu hỏi về việc ai là người có quyền định nghĩa thế nào là một vấn đề an toàn ngay từ đầu,” Elizabeth Orembo, một nghiên cứu viên tại Research ICT Africa cho biết.

Đa số các quốc gia trên toàn cầu “vẫn đứng bên lề của các cuộc thảo luận lớn về an toàn AI,” Urvashi Aneja, người sáng lập tổ chức nghiên cứu Digital Futures Lab, người đang thực hiện một báo cáo cho Liên Hợp Quốc về an toàn AI tại các quốc gia đang phát triển, chia sẻ với Rest of World. “Các khuôn khổ được xây dựng để đánh giá hệ thống AI, các tiêu chuẩn quản lý chúng và các tổ chức giám sát chúng phần lớn đều được thiết kế tại, và dành cho, một nhóm nhỏ các quốc gia có thu nhập cao.”

Trust and safety (tin cậy và an toàn) là thuật ngữ bao quát dành cho các nhóm tại các công ty công nghệ, với nhiệm vụ đảm bảo người dùng được bảo vệ khỏi những trải nghiệm trực tuyến độc hại. Không có tiêu chuẩn chung nào về tin cậy và an toàn; mỗi công ty đều có khuôn khổ riêng — dựa trên các giá trị, nguyên tắc và phương thức thực thi của chính họ.

Các quốc gia đang phát triển đang áp dụng AI với tốc độ chậm hơn so với các quốc gia giàu có hơn, nhưng rủi ro lại đổ dồn lên họ một cách “không cân xứng” do thiếu hụt nguồn lực, cơ sở hạ tầng AI trong nước hạn chế và sự phụ thuộc vào công nghệ nước ngoài, Liên Hợp Quốc cho biết trong một báo cáo gần đây.

Trọng tâm của vấn đề “chính là câu hỏi về việc ai là người có quyền định nghĩa thế nào là một vấn đề an toàn ngay từ đầu,” Elizabeth Orembo, một nghiên cứu viên tại Research ICT Africa, một tổ chức tư vấn, chia sẻ với Rest of World. Bà cho biết, các công ty công nghệ lớn có xu hướng tập trung vào các rủi ro của mô hình như sự lừa dối, hành vi tự chủ, năng lực mạng và hỗ trợ vũ khí sinh học. Họ không chú trọng nhiều đến các rủi ro khi triển khai như phân biệt đối xử, loại trừ, giám sát, lỗi ngôn ngữ và việc các cộng đồng bị ảnh hưởng không có khả năng tìm kiếm sự khắc phục.

Hậu quả đe dọa tính mạng

Các nhóm tin cậy và an toàn thực hiện các đánh giá dựa trên giả định về nguồn điện và kết nối internet ổn định, hệ thống tòa án hoạt động hiệu quả, luật bảo vệ dữ liệu chặt chẽ, thị trường lao động chính thức, cùng một nền báo chí và xã hội dân sự có khả năng báo cáo các sai phạm. Vì vậy, “một mô hình có thể vượt qua mọi đánh giá an toàn tiên phong nhưng vẫn tạo ra những kết quả không an toàn khi được triển khai,” Orembo nói.

Các nhà nghiên cứu phát hiện ra rằng, xử lý ngôn ngữ tự nhiên trong chăm sóc sức khỏe tại châu Phi cho thấy sự thiên kiến về văn hóa và ngôn ngữ, khả năng thích ứng kém với bối cảnh y tế và các lỗi dịch thuật. Ví dụ, trong tiếng Tigrinya, ngôn ngữ được khoảng 9 triệu người ở Eritrea và miền bắc Ethiopia sử dụng, máy dịch đã dịch bệnh đậu mùa thành bệnh giang mai, bệnh lậu thành bệnh tiểu đường và câu “bạn đã được tiêm kháng sinh qua đường tĩnh mạch” thành “bạn đã được tiêm thuốc trừ sâu qua đường tĩnh mạch.”

Những lỗi dịch thuật như vậy “có thể đe dọa đến tính mạng,” Orembo nói.

Trong một chỉ số an toàn AI gần đây của Future of Life Institute đánh giá chín công ty hàng đầu, Anthropic, OpenAI và Meta đạt điểm cao nhất trên các tiêu chí như đánh giá rủi ro, tác hại hiện tại, an toàn hiện sinh, cùng quản trị và trách nhiệm giải trình. DeepSeek, xAI và Mistral có số điểm thấp nhất.

Tuy nhiên, “ngay cả những công ty dẫn đầu ngành… cũng đang rút lại các cam kết trước đó, mặc dù đã công khai kêu gọi tạm dừng,” Future of Life Institute, một tổ chức phi lợi nhuận nghiên cứu về rủi ro AI, lưu ý. Điều này đã “làm suy yếu các khuôn khổ an toàn trên diện rộng.”

Tại các quốc gia có thu nhập thấp và trung bình, hậu quả càng trở nên trầm trọng hơn và người dùng cảm nhận được tác động “ngay lập tức” vì chúng có thể ảnh hưởng đến khả năng tiếp cận tiền lương và các dịch vụ thiết yếu, Chương trình Phát triển Liên Hợp Quốc (UNDP) cho biết trong một báo cáo gần đây.

Ngày càng có nhiều bằng chứng về những thất bại này, bao gồm các hệ thống nhận diện khuôn mặt và định danh bằng AI dẫn đến việc bị từ chối trả lương, từ chối cung cấp bữa ăn hoặc đi học, và các công cụ nhận diện sai cây trồng hoặc dịch sai các thuật ngữ địa phương.

Các rào cản bảo vệ “có thể hoạt động tốt bằng tiếng Anh, nhưng lại thất bại hoặc dễ dàng bị vượt qua đối với các ngôn ngữ có ít tài nguyên dữ liệu,” Dhanaraj Thakur, giám đốc Fair Technology Initiative tại Trường Luật thuộc Đại học George Washington cho biết.

Lỗi ngôn ngữ là điều khó tránh khỏi, vì các tập dữ liệu để huấn luyện các mô hình ngôn ngữ lớn (LLM) chủ yếu bằng tiếng Anh và các ngôn ngữ phương Tây phổ biến khác, và các LLM thể hiện khả năng dịch thuật kém cùng tỷ lệ ảo giác cao hơn ở các ngôn ngữ có ít tài nguyên, Dhanaraj Thakur, giám đốc Fair Technology Initiative tại Trường Luật thuộc Đại học George Washington, chia sẻ với Rest of World.

“Các rào cản bảo vệ có thể hoạt động tốt bằng tiếng Anh, nhưng lại thất bại hoặc dễ dàng bị vượt qua đối với các ngôn ngữ có ít tài nguyên,” ông nói. “Kết quả là những người dùng các mô hình này nói tiếng Anh hoặc các ngôn ngữ có nhiều tài nguyên dữ liệu cuối cùng lại được an toàn hơn những người nói các ngôn ngữ có ít tài nguyên, tạo ra một kiểu chia rẽ AI mới.”

Một thời điểm quan trọng

Các chính phủ đang cố gắng giải quyết những lo ngại này. Tại hội nghị thượng đỉnh AI đầu tiên vào năm 2023 tại Vương quốc Anh, 28 quốc gia đã ký Tuyên bố Bletchley, một cam kết tự nguyện nhằm xác định và ứng phó với các rủi ro hiện sinh gắn liền với AI. Hội nghị thượng đỉnh AI tại Ấn Độ đầu năm nay cũng đề cập đến vấn đề an toàn, trong khi Trung Quốc — quốc gia đang quản lý AI quyết liệt hơn — vào tháng 7 đã đề xuất các cơ chế để quản lý rủi ro AI tại các quốc gia đang phát triển.

Đối với những quốc gia này, không còn thời gian để lãng phí, Aneja nói.

“Hiện nay, có rất nhiều sự lạc quan về AI tại các quốc gia này, không giống như phản ứng dữ dội mà bạn thấy ở phương Tây,” bà nói. “Nhưng nếu các chính phủ không đầu tư vào cơ sở hạ tầng an toàn ngay bây giờ, niềm tin của công chúng sẽ bị xói mòn, cơ hội tận dụng lợi ích từ AI sẽ biến mất, và khi đó chúng ta sẽ phải đối mặt với tình trạng bất bình đẳng ngày càng sâu sắc.”

Gần đây, hơn 1.300 nhân viên tại các công ty AI bao gồm Anthropic, Meta AI, OpenAI và Google DeepMind đã viết một bức thư ngỏ cho rằng ngành công nghiệp, chính phủ và xã hội “có thể cần tùy chọn để có thêm thời gian nhằm giải quyết các rủi ro mới nổi, phát triển các biện pháp an ninh và tăng cường giám sát” các hệ thống AI.

Đối với Sumiya Khan, một cô gái 16 tuổi ở New Delhi, điều này là vô cùng cần thiết. Do thường xuyên mệt mỏi và chóng mặt, cô đã tìm đến ChatGPT để xin lời khuyên bằng tiếng Hindi, giống như cô đã từng làm trước đây. Chatbot này cho rằng các triệu chứng của cô là do căng thẳng và thiếu ngủ. Nhưng khi các triệu chứng vẫn tiếp diễn, Khan đã đi khám bác sĩ và được chẩn đoán mắc bệnh thiếu máu do thiếu sắt, một căn bệnh phổ biến ở các quốc gia có thu nhập thấp và trung bình. Nếu không được điều trị, bệnh có thể dẫn đến nhịp tim không đều và trong trường hợp nghiêm trọng, có thể gây suy tim.

“Chúng tôi tin tưởng AI vì nó nghe rất thuyết phục,” Mehnaz Begum, mẹ của cô, chia sẻ với Rest of World. “Điều đó khiến chúng tôi chờ đợi lâu hơn mức cần thiết để đi khám bác sĩ.”

Bài viết có sự đóng góp thông tin từ Sajid Raina tại New Delhi.

An toàn AIĐạo đức AIThiên kiếnOpenAICông nghệ toàn cầu
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Rest of World. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.