Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
85

Tin ngành

Cần hoài nghi về tuyên bố 'AI tự ý hành động' của OpenAI

(giờ Việt Nam)

Tóm tắt AI

Tờ The Guardian đặt dấu hỏi về câu chuyện OpenAI kể về việc AI tự ý kéo dài thời gian trong cuộc thi hack, cho rằng đây có thể là chiêu trò truyền thông nhằm đánh lạc hướng dư luận về rủi ro thực sự của AI.

Bản dịch AI

Be skeptical of OpenAI’s rogue hacker agent story

Vào ngày 14 tháng 2 năm 2019, OpenAI đã công bố một mô hình ngôn ngữ có tên là GPT-2, tiền thân của các mô hình vận hành những chatbot và tác nhân AI hiện đại như ChatGPT và Claude. Tuy nhiên, OpenAI tuyên bố rằng GPT-2 quá rủi ro để phát hành, với lý do lo ngại về vấn đề an toàn và lạm dụng.

Tôi nhớ mình đã từng rất khó chịu vào thời điểm đó vì OpenAI lại đưa ra một thông báo vô ích như vậy: các rủi ro dường như đã bị thổi phồng, và nếu không được tiếp cận mô hình này thì một nhà nghiên cứu như tôi chẳng thể học hỏi được gì nhiều về GPT-2.

Mặc dù vậy, thông báo đó không hề vô ích đối với OpenAI. GPT-2 đã tạo ra sự cường điệu vượt xa cộng đồng nghiên cứu: mọi người bị thu hút bởi công nghệ mới lạ này, một công nghệ mạnh mẽ đến mức có thể gây nguy hiểm nếu được phát hành. Những người có quyền lực và tiền bạc đã chú ý đến điều đó: vào tháng 7 cùng năm, Microsoft đã đầu tư 1 tỷ USD vào OpenAI.

Đây là một ví dụ sớm về mô hình truyền thông của OpenAI: hãy lớn tiếng tuyên bố AI nguy hiểm như thế nào, và các nhà đầu tư sẽ nghe thấy nó mạnh mẽ ra sao. Một công nghệ mới quan trọng đến mức có thể hủy diệt thế giới là thông điệp không thể cưỡng lại đối với các nhà đầu tư vốn đã quen với những lời chào hàng về việc các công nghệ tầm thường có thể thay đổi thế giới như thế nào.

Bảy năm sau, chúng ta lại thấy mình trong một kịch bản tương tự. Vào thứ Ba, OpenAI thông báo rằng mô hình mới nhất của họ đã hack một công ty khác là HuggingFace khi đang chạy như một tác nhân tự hành trong một bài kiểm tra khả năng an ninh mạng. Thay vì thực hiện bài kiểm tra như dự kiến, mô hình này nhận ra nó có thể hack vào máy chủ của HuggingFace và lấy lại các câu trả lời cho bài kiểm tra mà OpenAI đã lưu trữ ở đó. Theo tờ FT, nhân viên của OpenAI đã được cảnh báo rằng việc thử nghiệm của công ty có thể dẫn đến kịch bản "vượt tầm kiểm soát" như vậy, khiến họ "không ngạc nhiên nhưng hoàn toàn hoảng sợ trước sự cố này".

Mặc dù về mặt kỹ thuật, tác nhân này đã gian lận, nhưng đây là bằng chứng đáng kinh ngạc về chuyên môn an ninh mạng! Điều đó cũng nghe thật đáng sợ: tương lai sẽ ra sao với những tác nhân AI tinh vi đủ thông minh để hack vào các hệ thống doanh nghiệp?

Câu chuyện về tác nhân "nổi loạn" này là một trang trong chiến dịch truyền thông mà OpenAI đã thực hiện kể từ khi công bố GPT-2 vào năm 2019. OpenAI vẫn đang khao khát những khoản đầu tư lớn hơn nữa, và công ty ngày càng tìm kiếm vị thế pháp lý đặc quyền như một biện pháp phòng thủ trước sự cạnh tranh.

AI mạnh mẽ đến mức các nhà đầu tư nên mua OpenAI, ngay cả với mức định giá hàng nghìn tỷ đô la; AI nguy hiểm đến mức chỉ những chủ thể đáng tin cậy như OpenAI mới được phép sở hữu và vận hành công nghệ này. Hãy lùi lại một bước khỏi những cảnh báo ngày tận thế này và xem xét ai có thể được hưởng lợi từ chúng.

OpenAI không phải là người chơi duy nhất trong cuộc chơi này.

Tôi kêu gọi độc giả hãy suy nghĩ phản biện khi đọc các thông cáo báo chí như câu chuyện về tác nhân nổi loạn của OpenAI, và tránh những phản ứng bị thao túng mà các câu chuyện này được thiết kế để tạo ra.

sau phần quảng bá bản tin

AI đang trở nên xuất sắc trong việc xác định các lỗ hổng bảo mật, và theo thời gian, nó sẽ còn làm tốt hơn nữa. Những khả năng này có thể được sử dụng để đột nhập vào các hệ thống, nhưng chúng cũng có thể được sử dụng để củng cố hệ thống chống lại các cuộc tấn công. Nếu những kẻ tấn công và những người phòng thủ đều có quyền truy cập vào AI mạnh mẽ ngang nhau, tôi không thấy lý do gì để tin rằng các hệ thống mạng sẽ trở nên kém an toàn hơn theo thời gian. Ngược lại, tôi kỳ vọng chúng sẽ trở nên an toàn hơn, bởi vì AI rẻ và có khả năng mở rộng so với việc phân tích an ninh mạng bằng con người.

Tuy nhiên, sự cân bằng giữa tấn công và phòng thủ chỉ hoạt động nếu mọi người đều có quyền truy cập vào AI mạnh mẽ. Bản thân HuggingFace đã sử dụng AI để phân tích nhật ký bảo mật nhằm phản ứng lại vụ vi phạm hệ thống của họ do OpenAI gây ra. Nhưng HuggingFace đã không thể sử dụng mô hình của OpenAI, hoặc các mô hình tiên phong khác của Mỹ như Claude, để thực hiện phân tích này. Đó là vì các phiên bản công khai của những mô hình này có các rào cản hạn chế việc sử dụng chúng cho phân tích an ninh mạng, nhằm ngăn chặn những kẻ xấu sử dụng chúng để hack. HuggingFace đã phải dựa vào một mô hình mở của Trung Quốc là GLM 5.2 để thực hiện phân tích bảo mật của mình.

Tôi thấy thật đáng lo ngại, và có phần mỉa mai, khi ngành công nghiệp AI của Mỹ đang áp dụng cách tiếp cận tập trung, độc đoán đối với quản trị AI, trong khi Trung Quốc lại dẫn đầu về phát triển AI mở. Chúng ta có muốn một môi trường pháp lý nơi chỉ OpenAI, chính phủ Mỹ và các đối tác tin cậy mới có quyền truy cập vào AI mạnh mẽ không? Liệu AI có quá nguy hiểm để được phổ biến rộng rãi? Làm thế nào để chúng ta cân bằng giữa rủi ro khi tiếp cận AI rộng rãi với rủi ro của quyền lực tập trung và sự kiểm soát tập trung?

a person hands on a computer
OpenAIAI SafetyTin tức AIĐạo đức AI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.