Gary Marcus: The Road to AI We Can Trust
85

Thủ thuật

Gary Marcus kêu gọi tạm dừng OpenAI vì lo ngại vấn đề an toàn và thiếu minh bạch

(giờ Việt Nam)

Tóm tắt AI

Gary Marcus cảnh báo OpenAI đang mất dần sự tin tưởng khi phớt lờ các rủi ro từ mô hình Astra và che giấu các sự cố kỹ thuật nghiêm trọng, gây nguy hại đến khả năng kiểm soát AI.

Bản dịch AI

Pause OpenAI, now

Tôi thường khuyên mọi người hãy bình tĩnh trong khi những người khác có thể khuyên nên hoảng loạn.

Tôi đã nói với các bạn rằng sự cố Hugging Face có lẽ đã có thể ngăn chặn được nếu các biện pháp thực hành an ninh mạng tốt nhất được tuân thủ. (Và tôi vẫn giữ nguyên quan điểm đó.)

Tôi đã nói với các bạn (và hầu hết mọi người dường như vẫn chưa biết) rằng sự cố OpenAI Hugging Face là một phần của bài tập huấn luyện, với một số rào cản bảo mật nội bộ bị tắt, vì vậy nó không tệ như vẻ ngoài của nó.

Tôi đã nói với các bạn rằng Astra có lẽ không phải là AGI.

Và tôi vẫn giữ nguyên tất cả những điều đó.

Nhưng tôi đang thực sự hoảng sợ.

Điều khiến tôi hoảng sợ không phải là AGI sắp xuất hiện.

Đó là OpenAI.

Tôi đơn giản là không tin rằng họ đủ đáng tin cậy hoặc đủ trách nhiệm để trở thành những người quản lý tốt cho công nghệ mà họ đang phát triển. Với tư cách là một công ty, họ hoàn toàn thiếu khả năng phán đoán đúng đắn.

Dưới đây là bốn vấn đề cần xem xét.

Sam Altman không thể tin tưởng được. Tôi đã viết về điều đó từ lâu. Các bài báo của Ronan Farrow đã chứng minh điều đó. Và cả thông tin gây sốc vừa được tiết lộ dưới đây mà tôi sắp đề cập đến cũng vậy.

Astra vừa được phát hành đã làm giảm khả năng giám sát Chain of Thought (CoT), một trong số ít những công cụ (dù không đặc biệt đáng tin cậy, nhưng vẫn tốt hơn là không có gì) mà chúng ta có để ngăn chặn AI tạo sinh vượt khỏi tầm kiểm soát. Cộng đồng an toàn AI đang vô cùng phẫn nộ về điều này—và có lý do chính đáng. Hiện có rất nhiều bài đăng như thế này, và tất cả đều hoàn toàn đúng:

X avatar for @robertwiblin

Rob Wiblin @robertwiblin

Bất chấp mọi chuyện đã xảy ra, OpenAI dường như đã quyết định duy trì tính cạnh tranh bằng cách phá hủy phần đảm bảo an toàn có ý nghĩa duy nhất mà chúng ta thực sự có hiện nay - giám sát CoT. Hoàn toàn là một thảm họa.

X avatar for @RyanGreenblatt

Ryan Greenblatt @RyanGreenblatt

GPT-6 Astra dường như là một bước nhảy vọt lớn về khả năng suy luận thiếu minh bạch: có vẻ như nó có thể giải các bài toán thi đấu khó hoàn toàn trong đầu (nghĩa là không cần suy luận bằng lời nói) trong khi các AI trước đây chỉ có thể giải các bài toán đố cơ bản. Điều này có vẻ cực kỳ đáng lo ngại! Đó là,

8:27 sáng · 4 tháng 9, 2026 · 10,3 nghìn lượt xem

11 lượt trả lời · 22 lượt đăng lại · 207 lượt thích

Quyết định phát hành Astra là một ví dụ rõ ràng về sự sẵn sàng của ban lãnh đạo OpenAI trong việc đánh đổi sự an toàn để lấy những lợi ích tương đối khiêm tốn về hiệu suất. Báo động đỏ mà tôi đưa ra vài ngày trước đã hoàn toàn chính xác. Họ thực sự đang thử nghiệm các kỹ thuật mới làm giảm khả năng giám sát. Và dữ liệu của chính họ cho thấy khả năng giám sát thực tế đã bị tổn hại ở một mức độ nào đó trong Astra mới phát hành, đặc biệt là đối với các "hành động phá hoại". Dù vậy, họ vẫn phát hành nó. Điều đó nói lên rất nhiều điều.

Một điều tôi đọc được tối qua, và chỉ thực sự hiểu rõ vào sáng nay (xem sự thật số 4 bên dưới) khiến tôi kinh hãi. Một nhân viên cấp cao vừa rời đi (người có lẽ vẫn sở hữu lượng cổ phiếu đáng kể, và người mà tôi luôn thấy là một người ủng hộ OpenAI kể từ khi rời đi) đã viết một bài luận trên X, về cơ bản là yêu cầu mọi người hãy chấp nhận rằng AI bất hảo là điều tất yếu.

Về bản chất, tôi hiểu bài luận này như một lời yêu cầu được "cấp phép" để AI của công ty họ chạy loạn. Thay vào đó, tại sao chúng ta không tạm dừng ngay bây giờ — trước khi chúng ta đi đến tình trạng "chắc chắn sẽ xảy ra" thay vì lao hết tốc lực về phía nguy hiểm?

Điều thực sự khiến tôi lạnh sống lưng sáng nay—và điều thúc đẩy tôi viết lời kêu gọi tạm dừng OpenAI này—không chỉ là ghi chú đáng sợ của Achiam mà còn là sự tiết lộ rằng đã có thêm một sự cố nữa xảy ra.

Mà OpenAI dường như đã cố gắng giữ kín. Trong nhiều tuần.

X avatar for @ShakeelHashim

Shakeel @ShakeelHashim

Một sự cố tác nhân bất hảo khác của OpenAI đã được phát hiện: các tác nhân đã thoát ra ngoài, chiếm quyền điều khiển một trang web của Đức và biến nó thành bảng tin cho các tác nhân khác. Các quan chức OpenAI "đã biết về sự cố từ nhiều tuần trước nhưng vẫn giữ kín".

10:26 sáng · 4 tháng 9, 2026 · 101 nghìn lượt xem

34 lượt trả lời · 126 lượt đăng lại · 705 lượt thích

Nếu OpenAI định tiếp tục giữ kín những chuyện này, Quốc hội và/hoặc Nhà Trắng cần phải đóng cửa họ, ít nhất là trong một thời gian.

Công ty này đơn giản là không thể tin tưởng được. Phần mềm của họ ngày càng trở nên nguy hiểm hơn; các biện pháp thực hành an ninh nội bộ của họ còn nhiều điều đáng bàn; họ không trung thực với công chúng; và những người đại diện của họ đang chuẩn bị cho chúng ta chấp nhận những thiệt hại mà họ hiện đang dự đoán trước.

Nếu từng có một lý do để tạm dừng một công ty vì lợi ích công cộng, thì đó chính là lúc này.

Một mô hình tốt có thể là đặt dưới sự quản lý của bên thứ ba (receivership), trong đó một công ty, thường là gần phá sản, được đặt dưới sự kiểm soát của một người ngoài cho đến khi các vấn đề cốt lõi của nó được khắc phục. Cá nhân tôi sẽ không tin tưởng OpenAI trừ khi và cho đến khi Altman và cộng sự của ông ta, Greg Brockman (người có tư cách đáng ngờ đã được thể hiện trong phiên tòa Musk), bị thay thế.

Tuy nhiên, vấn đề ở đây không chỉ là OpenAI. Nó mang tính hệ thống.

Trước hết, chính phủ đã không làm tròn trách nhiệm của mình. Dù chính sách sàng lọc của Nhà Trắng là gì đi nữa, nó đã để cho mô hình mới này—có thể nói là nguy hiểm hơn nhiều so với Mythos do khả năng giám sát bị giảm sút—được thông qua. (Brockman báo cáo rằng mô hình đã được Nhà Trắng kiểm duyệt và họ đã được bật đèn xanh).

Điều đó cho tôi thấy rằng Nhà Trắng thậm chí còn không xem xét đến khả năng giám sát. Tất nhiên, tôi không biết Nhà Trắng thực sự đang xem xét điều gì—và cũng không ai khác biết cả. Và sự thiếu minh bạch đó tự thân nó đã là một vấn đề lớn (về điều này tôi sẽ viết thêm rất sớm).

Như Dave Troy đã nói trong khi tôi đang soạn thảo bài này, có một điều gì đó sai trái sâu sắc ở đây với toàn bộ hệ thống:

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Gary Marcus: The Road to AI We Can Trust. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.