Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
85

Thủ thuật

Nhà nghiên cứu tại Anthropic từ bỏ cổ phần, cảnh báo về cuộc đua siêu trí tuệ nguy hiểm

(giờ Việt Nam)

Tóm tắt AI

Jacob Coxon, chuyên gia nghiên cứu tiền huấn luyện tại OpenAI và Anthropic, đã từ chức ngay trước thời điểm nhận cổ phần để phản đối việc các công ty này đang đánh cược mạng sống nhân loại trong cuộc đua phát triển siêu trí tuệ.

Bản dịch AI

Hôm nay tôi đã từ chức tại Anthropic. Tôi đã dành ba năm qua để thực hiện nghiên cứu tiền huấn luyện (pretraining) tại cả OpenAI và Anthropic. Không công ty nào trong số đó đang hành động có trách nhiệm. Họ đang chạy đua trực diện tới trí tuệ siêu việt tự cải tiến (self-improving superintelligence) và đánh cược với mạng sống của chúng ta. Những suy nghĩ khác ở bên dưới.

Đây là cách Jacob Coxon nói lời chia tay với ngành công nghiệp AI trên X vào tuần trước.

Và trong một bài đăng tiếp theo:

“Những người đang xây dựng AI thực sự tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này. Đây không phải là một chiêu trò tiếp thị.”

Jacob Coxon không phải là một ngôi sao. Anh ấy không phải là CEO, không phải là nhà khoa học nổi tiếng và không có bằng Tiến sĩ (vâng, ở Mỹ, bạn có thể là một “nhà nghiên cứu AI” mà không cần bằng Tiến sĩ). Anh gia nhập Anthropic ở tuổi 27, chủ yếu vì danh tiếng về an toàn của công ty, và anh thích giải quyết các vấn đề cũng như “làm cho thế giới trở nên tốt đẹp hơn”.

Nói cách khác, anh ấy là một kỹ sư. Giống như hầu hết chúng ta.

Nhưng anh ấy đã làm điều mà hầu hết chúng ta không bao giờ làm: anh ấy rời đi hai tháng trước khi cổ phiếu của mình được quyền sở hữu (vested), và từ bỏ nó để lên tiếng.

“Tôi không còn được lợi gì từ việc thổi phồng định giá của Anthropic nữa. … Tôi đã rời đi trước khi bất kỳ cổ phiếu nào của mình được quyền sở hữu.”

Lưu ý rằng anh ấy không gọi Anthropic là “tàn ác”. Anh ấy thậm chí còn nói với tờ Wall Street Journal rằng công việc về an toàn của họ là chân thành. Lời buộc tội của anh ấy lạnh lùng hơn thế: “nếu bạn chịu áp lực phải chạy đua, bạn buộc phải cắt giảm các tiêu chuẩn”.

Bạn có thể cho rằng phản ứng này là quá mức. Một lá thư từ chức, hơn 115 triệu lượt xem, một cơn thịnh nộ trên mạng xã hội giữa các kỹ sư, doanh nhân, hay đơn giản là những con người, và các nhà lập pháp đột nhiên kêu gọi quy định. Nhưng đó chính xác là vấn đề: khi sự ra đi của một kỹ sư duy nhất làm cả thế giới báo động, nó cho bạn biết điều mà thế giới đã nghi ngờ: khi những người bên trong cỗ máy nói rằng thứ này nguy hiểm, thì tiếng ồn đó giống một triệu chứng hơn là một tin đồn xấu.

Những người trong cuộc đã tự xác nhận điều đó. Evan Hubinger, trưởng nhóm căn chỉnh (alignment team) tại Anthropic, đã viết:

“Jacob nói đúng ở đây—chúng tôi thực sự tin rằng AI có thể giết chết tất cả con người! Cá nhân tôi nghĩ khả năng đó là >10% trong thập kỷ tới. Tôi tin rằng Anthropic đang cố gắng hết sức, nhưng chúng tôi vẫn chưa có kế hoạch để giải quyết vấn đề căn chỉnh cho trí tuệ siêu việt và rõ ràng là chưa đi đúng hướng.”

Chúng ta đã từng xem bộ phim này trước đây #

Năm năm trước, một nhân viên khác đã nhìn vào nghiên cứu nội bộ của chính công ty mình và đối mặt với lựa chọn tương tự.

Các slide của chính Facebook, được tiết lộ bởi “Facebook Files” của tờ Wall Street Journal:

“Chúng tôi làm cho các vấn đề về hình ảnh cơ thể trở nên tồi tệ hơn đối với một trong ba cô gái tuổi teen.”

và:

“Trong số những thanh thiếu niên báo cáo có ý nghĩ tự tử, 13% người dùng Anh và 6% người dùng Mỹ cho rằng mong muốn tự sát bắt nguồn từ Instagram.”

Frances Haugen đã không nhún vai bỏ qua. Cô ấy thu thập các tài liệu, từ chức và làm chứng trước Thượng viện Hoa Kỳ.

Coxon năm 2026, Haugen năm 2021. Những công ty khác nhau nhưng cùng một hành động: họ từ chối, họ rời đi và họ cảnh báo thế giới bên ngoài.

Mô hình này chính là vấn đề. Trong cả hai trường hợp, công ty đều biết. Và trong cả hai trường hợp, một người bên trong đã phải quyết định xem liệu việc biết thôi đã đủ hay chưa.

Căn bệnh #

Thật dễ dàng để quy mọi thứ về một vài công ty xấu xa. Nhưng sẽ khó chịu hơn, và chính xác hơn, khi nhìn vào nền văn hóa đang nuôi dưỡng chúng: văn hóa của chính chúng ta.

Các kỹ sư ngày nay được yêu cầu tôn thờ năng suất và coi chất lượng là một thứ xa xỉ. Một cuộc khảo sát lớn năm 2026 về nhân viên công nghệ đã tóm tắt tình hình bằng câu nói của một người trả lời:

“Tôi có thể làm nhiều hơn, nhanh hơn, nhưng không tốt hơn.”

Cuộc khảo sát tương tự gọi tên tình trạng này là: sự kiệt sức mỉm cười. Mọi người đang tiếp tục vận chuyển sản phẩm, thù lao đã tăng lên và không có nút tắt. Hơn một nửa số nhân viên công nghệ (53%) sẽ khuyên người mới tránh xa lĩnh vực của chính họ, nhưng họ vẫn ở lại. Một báo cáo khác về phân phối phần mềm cho thấy 67% lập trình viên hiện dành nhiều thời gian hơn để gỡ lỗi mã do AI tạo ra. Chúng ta chấp nhận sự cẩu thả, chúng ta chấp nhận sự kiệt sức, chúng ta chấp nhận nhìn chất lượng công việc của chính mình trượt dốc, tất cả chỉ vì thù lao.

Điều này không chỉ giới hạn ở các phòng thí nghiệm AI. Đó là cùng một phản xạ khiến các kỹ sư hợp lý hóa các sản phẩm giám sát, thuật toán gây nghiện, hợp đồng quốc phòng và công việc đại lý bằng một cái nhún vai: “nếu tôi từ chối, người khác tệ hơn sẽ làm điều đó”.

Tôi đã viết trước đây rằng sự thoải mái là kẻ thù của kỹ năng, nhưng tôi đã quá nhẹ nhàng vì cuối cùng, chúng ta có thể thấy rằng sự thoải mái là kẻ thù của trách nhiệm.

Đánh đổi đạo đức lấy tiền bạc không phải là một quyết định nghề nghiệp mà là một giao dịch. Đó là một giao dịch mà bạn bán đi phần con người lẽ ra phải biết quan tâm của mình. Làm điều đó đủ nhiều, và nó sẽ không bao giờ quay trở lại. Đó không phải là kiệt sức (burnout), nhưng nó vẫn là một căn bệnh. Mặc dù vậy, giống như mọi căn bệnh, nó lây lan: đầu tiên là đến nhóm của bạn, sau đó đến sản phẩm của bạn, rồi đến những người sử dụng nó.

Lời buộc tội #

Vậy, tại sao bạn vẫn làm việc cho họ?

Nếu câu trả lời là vì tiền lương, hãy nói to hơn, và đừng ép mình phải đưa ra lời bào chữa. Nếu câu trả lời là “người khác tệ hơn sẽ thay thế tôi”, hãy nói điều đó, và cũng hãy nói to hơn. Nếu câu trả lời là “tôi có thể thay đổi mọi thứ từ bên trong”, thì hãy cho tôi thấy những gì bạn đã thay đổi. Haugen đã thử từ bên trong. Coxon đã thử từ bên trong. Cuối cùng, thật không may, bên trong đã không hề lay chuyển.

Chúng ta sống trong một xã hội, và mọi hành động chúng ta thực hiện đều mang một trách nhiệm. Bạn có thể phớt lờ nó, nhận thù lao, cúi đầu làm việc và tự nhủ rằng mình chỉ là một kỹ sư đang xây dựng các tính năng… Nhưng khi đó, đừng coi mình là người đóng góp cho nhân loại. Bạn chỉ là một con người đang nghĩ về bản thân mình, không hơn không kém.

Những người từ chối không phải là anh hùng mà là con người, và những người tốt sẽ từ chối làm những điều xấu xa.

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.