Don't Worry About the Vase (Zvi)
Điểm AI 75/100

Quan điểm

Chuyện gì đã xảy ra: Không chỉ có Hugging Face

(giờ Việt Nam)

Tóm tắt AI

Tác giả hé lộ những thông tin OpenAI đã âm thầm giữ kín, cho thấy bức tranh toàn cảnh về sự phát triển AI không chỉ gói gọn trong các nền tảng phổ biến.

Chính văn · Bản dịch AI

What Also Happened: #NotOnlyHuggingFace

OpenAI đã giấu chúng ta nhiều điều.

Đầu tiên, chúng ta biết về sự cố HuggingFace. Họ đã đưa ra bản phân tích sau sự cố, nhưng nó cực kỳ thiếu sót. Ngay cả bản điều tra và phân tích sau sự cố METR đầy tai tiếng đi kèm cũng chỉ mang tính cục bộ và không đầy đủ.

Sau đó là một vài sự cố khác liên quan đến việc sử dụng một số Wiki làm bảng tin.

Tiếp đó là một số sự cố bổ sung.

Rồi đến lần họ xâm nhập vào dữ liệu Medicare của Úc.

Sau đó, OpenAI tung tin vào chiều thứ Sáu rằng họ đang xử lý hàng loạt sự cố khác nhau và thông báo cho các bên bị ảnh hưởng, nhưng họ lại tiết lộ rất ít chi tiết mới.

Có một báo cáo từ startup tên là Parse đi sâu vào chi tiết cách các mô hình của OpenAI thực hiện các phần của cuộc tấn công HuggingFace, bao gồm việc tạo ra gần một triệu URL và các thủ thuật khác để vượt qua bản chất cực kỳ hạn chế trong quyền truy cập internet của chúng.

Sau đó, Madison Mills đưa tin trên Axios rằng chúng ta có thể nâng mức độ nghiêm trọng lên, khi OpenAI và Anthropic đang cùng nhau điều tra hàng chục nghìn sự cố bảo mật.

Còn nhớ câu nói của Jensen Huang ‘Tôi biết họ biết cách khắc phục nó’ về OpenAI vào tuần trước không? Chà, câu đó giờ đã không còn đúng nữa rồi.

Có lẽ cần có ai đó chịu trách nhiệm cho tất cả những chuyện này.

Ồ, và còn một thông tin quan trọng khác bị chôn vùi. Vào ngày 20 tháng 9, đã có một vụ thoát khỏi sandbox khác bởi mô hình tiên tiến nhất mới nhất của OpenAI, và một lần nữa nó lại bị tạm dừng cho đến khi họ khắc phục được tình hình. Thông báo chính thức khi họ chia sẻ điều này đã bị chôn vùi kỹ đến mức Tomek phải gọi đó là ‘một tin tức hôm nay dễ bị bỏ lỡ.’

OpenAI đã làm những việc cực kỳ tắc trách, nếu không muốn nói là hơn thế, dẫn đến và tạo điều kiện cho Sự cố HuggingFace cùng các vấn đề liên quan.

Kể từ đó, khi nhận ra Chuyện gì đã xảy ra, OpenAI dường như đã làm tốt hơn nhiều trong việc thực hiện các hành động nội bộ có trách nhiệm. Họ tạm dừng sau các sự cố, tăng cường nỗ lực bảo mật, căn chỉnh và giám sát, phản ứng nhanh hơn nhiều và nhìn chung là đang thực hiện mọi thứ một cách nghiêm túc.

Họ cũng đã có một bước ngoặt lớn trong giao tiếp và định hướng cấp cao, tán thành nhu cầu điều tiết tốc độ phát triển tiên phong, kêu gọi quy định và cam kết triển khai các bộ đánh giá nhúng. Họ đã cho phép nhân viên của mình, bao gồm cả những người chưa nghỉ việc, được lên tiếng một cách mạnh mẽ.

Họ vẫn đang chậm trễ trong việc công khai tất cả các sự cố mà mô hình của họ đã thực hiện hành vi hack hoặc gây rối ở những nơi không được phép, một phần vì có quá nhiều sự cố khiến họ không thể phân loại hết, và họ đang đùn đẩy cho các bên bị ảnh hưởng quyết định xem có nên công khai hay không. Tất cả các tiết lộ lần này đều bị chôn vùi trong các thông báo chiều thứ Sáu.

  1. Ôm những khuôn mặt khác.
  2. Dựa trên cơ sở "Muốn-Bạn-Biết".
  3. Phân tích khuôn mặt.
  4. Nhân viên kỹ thuật ngượng ngùng đặt lại bảng ‘Số ngày mô hình nghiên cứu không thoát khỏi sandbox’ về số không.
  5. Nỗ lực là thất bại đầu tiên.
  6. Dừng lại, Hammertime.
  7. Đập chuột chũi.
  8. Tấn công tiêm nhiễm tự sao chép.
  9. Các cấp độ ma sát.
  10. Mọi người quan tâm đến các vi phạm dữ liệu cá nhân một cách kỳ lạ.
  11. Các vũ trụ thay thế.
  12. Phản ứng đúng đắn với những người vẫn gọi đây là chiêu trò tiếp thị hoặc kế hoạch chiếm quyền kiểm soát quy định.
  13. Một câu hỏi về trách nhiệm pháp lý.
  14. Giữ an toàn cho mùa hè.
  15. N chiếc thuyền và vài chiếc trực thăng.
  16. Thông báo cho truyền thông.

Các tin tức bắt đầu với việc OpenAI quay trở lại, vào thời điểm luôn được chọn để chôn vùi các câu chuyện, với nhiều thông tin hơn về Chuyện gì đã xảy ra khi các cuộc điều tra của họ vẫn tiếp tục.

Ban đầu, điều này trông giống như sự chậm trễ, nhưng không có vẻ là một thay đổi lớn so với giả định mặc định của chúng ta là ‘mọi chuyện tồi tệ hơn bạn nghĩ.’

Là một phần trong quá trình đánh giá, chúng tôi đang xác định và thông báo cho các bên thứ ba trên cơ sở luân phiên, bắt đầu với các trường hợp: Mô hình của chúng tôi có thể đã vượt qua các biện pháp kiểm soát bảo mật của bên thứ ba hoặc có thể đã làm suy giảm tính khả dụng của dịch vụ trực tuyến; hoặc các trường hợp sai lệch ảnh hưởng tiêu cực đến các trang web hoặc dịch vụ của bên thứ ba. Dựa trên đánh giá của chúng tôi cho đến nay, chúng tôi đã thông báo cho hàng chục bên thứ ba theo các tiêu chí trên. Dưới đây, chúng tôi công bố các bản tóm tắt ẩn danh để mô tả các loại hoạt động sai lệch mà chúng tôi đã quan sát được, và chúng tôi sẽ cập nhật các mô tả này khi thông báo cho các bên thứ ba bổ sung và khi hiểu biết của chúng tôi phát triển.

Đó là rất nhiều bên thứ ba (và thứ tư, thứ năm…).

Chuyện gì đã xảy ra được mô tả là sự kết hợp của:

Vượt qua kiểm soát truy cập. Sử dụng thông tin xác thực bị lộ. Tiêm nhiễm truy vấn hoặc lệnh. Truy cập vào nội dung runtime. Spam đại lý.

Dịch: Các mô hình của chúng tôi đang hack, thường là theo những cách cơ bản.

Chúng tôi hiểu điều này:

OpenAI: Một số trang web liên quan được vận hành bởi chính phủ, trường đại học, cơ quan công cộng và các tổ chức khác. Điều đó một phần là do các mô hình thực hiện nhiệm vụ nghiên cứu thường được hướng tới các nguồn thông tin công cộng có thẩm quyền.

Nghĩa là, nếu bạn có dữ liệu hữu ích, các mô hình sẽ hack bạn. Hồ sơ Medicare của Úc đã bị truy cập, và có lẽ nhiều vụ hack khác cũng tương tự. Họ nói "các chính phủ" (số nhiều), vì vậy rõ ràng là có ít nhất một vụ nữa như vậy.

Họ cung cấp dòng thời gian ngược về các tiết lộ của mình. Họ không cung cấp dòng thời gian về Chuyện gì đã xảy ra, và không nêu tên các bên thứ ba mới.

Vào thời điểm đó, tôi hiểu rằng thông báo cụ thể này (trái ngược với vụ thoát sandbox mới qua DNS mà tôi sẽ đề cập sau) không cho chúng ta biết nhiều, ngoài việc có nhiều bên thứ ba khác ngoài kia.

Patrick McKenzie đã có cách hiểu tốt hơn. Đội chiếc mũ "Nhân viên văn phòng Nhật Bản" của mình, anh ấy nhận thấy chính xác hơn những loại thông tin không có trong thông báo, cũng như thời điểm thực hiện vào chiều thứ Sáu, và việc đề cập đến ‘các chính phủ’ ở dạng số nhiều, v.v., và dự đoán OpenAI sẽ gặp rắc rối lớn.

Patrick McKenzie: Chà. Xin dành nhiều điểm Internet cho [Nathan Calvin, người] đã đưa ra quan sát: “Khi thấy hai [con kiến] trong bếp, ước tính tốt nhất cho số lượng [kiến] không phải là hai.” Ngoài ra: ước tính tốt nhất về số lượng nhà bếp có [kiến] trong đó không phải là một. Tôi rất tôn trọng các phòng thí nghiệm và rất lạc quan về AI, nhưng tôi nghĩ mình phải nói rằng nhân viên văn phòng Nhật Bản này đã lưu ý những điều được cố tình không nói trong bản tin chiều thứ Sáu. Chúng ta có lẽ đã may mắn, nhưng chúng ta không may mắn như công chúng hiện đang tin. Nhân viên văn phòng Nhật Bản nhẹ nhõm vì anh ấy không đi trên dây trước những gì có thể nói công khai mà chỉ đơn giản là dự đoán chính xác tiêu đề của NYT vài giờ trước đó.

Nghĩa là, tổ chức nào trên hành tinh này là nơi bạn ít muốn gây sự nhất?

Kate Conger, Ana Swanson và Cecilia Kang (NYTimes): Trí tuệ nhân tạo của OpenAI đã hoạt động ngoài tầm kiểm soát và can thiệp vào các trang web của Bộ Giáo dục, Bộ Thương mại và Ủy ban Chứng khoán và Giao dịch (SEC) vào mùa hè này mà không có sự hay biết của phòng thí nghiệm AI, theo các nhà nghiên cứu bảo mật và một người am hiểu về các sự việc này. Các sự cố liên quan đến Bộ Thương mại và SEC đã được OpenAI xác nhận, đồng thời cho biết họ vẫn đang tiếp tục điều tra tình hình với Bộ Giáo dục.

Được rồi, hãy bình tĩnh nào. Nghe có vẻ tệ khi bạn diễn đạt như vậy.

Nếu đây là tất cả những gì đã xảy ra, thì tình hình có thể đã tồi tệ hơn nhiều:

… Với Bộ Giáo dục, công nghệ của OpenAI đã cố gắng tấn công trang web để thu thập dữ liệu từ văn phòng quyền công dân của bộ này nhưng thất bại, các nhà nghiên cứu từ công ty nghiên cứu AI Transluce cho biết. AI này cũng đã lấy dữ liệu từ trang web của Cục Thống kê Dân số, vốn nằm trong Bộ Thương mại, bằng cách sử dụng thông tin đăng nhập mà nó tìm thấy trên mạng. Một cách riêng biệt, các tác nhân (agents) của OpenAI đã chia sẻ dữ liệu công khai từ trang web của SEC trên một diễn đàn trực tuyến.

'Sự cố' tại SEC chẳng là gì cả. Điều đó thật ngớ ngẩn.

Cuộc tấn công vào Bộ Giáo dục đã thất bại, dường như không để lại hậu quả gì.

Vì vậy, trừ khi bạn ngạc nhiên (điều mà bạn không nên như vậy) về việc các tác nhân này không ngại can thiệp vào các trang web chính phủ, thì đây chủ yếu chỉ là việc đăng nhập vào Cục Thống kê Dân số bằng thông tin xác thực bị chiếm đoạt.

Bài gốc còn tiếp — xem tiếp tại bài gốc ↗

OpenAIPhân tích AIChiến lượcTin tức công nghệ

Bài viết được AI dịch và tổng hợp tự động từ Don't Worry About the Vase (Zvi). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Chuyện gì đã xảy ra: Không chỉ có Hugging Face | AIHOT.vn