Thủ thuật
CEO Anthropic đề xuất 3 chiến lược kiểm soát tốc độ phát triển AI tiên tiến
(giờ Việt Nam)
Tóm tắt AI
Dario Amodei kêu gọi làm chậm tiến độ phát triển AI và cam kết để bên thứ ba như METR tham gia đánh giá rủi ro, nhằm đảm bảo an toàn cho các mô hình thế hệ mới.
Bản dịch AI

Chúng ta đang ngày càng thấy nhiều cảnh báo nghiêm trọng từ các nhà nghiên cứu AI về những mối nguy hiểm của trí tuệ nhân tạo, và thậm chí cả những bình luận từ CEO OpenAI Sam Altman rằng đã đến lúc cần "điều tiết" tốc độ phát triển AI. Nhưng điều đó sẽ thực sự diễn ra như thế nào?
Trong một bài đăng trên blog mới đây, CEO Anthropic Dario Amodei không chỉ hưởng ứng lời kêu gọi "điều tiết tốc độ phát triển", mà còn vạch ra ba chiến lược tổng thể để thực hiện điều đó. Ông cũng cho biết Anthropic đang "đơn phương cam kết" thực hiện một trong số các chiến lược này.
Cuộc tranh luận về an toàn và sự liên kết (alignment) của AI đã trở nên gay gắt hơn trong tuần này sau khi nhà nghiên cứu Jacob Coxon viết rằng ông đang từ chức tại Anthropic vì lo ngại rằng các công ty AI hàng đầu đang "đánh cược với mạng sống của chúng ta" trong khi những người xây dựng công nghệ này "thực sự tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này", một tuyên bố cũng được những người khác tại Anthropic lặp lại.
Bài đăng của Amodei không đề cập trực tiếp đến việc từ chức hay những lo ngại của Coxon, nhưng vị CEO này viết rằng có hai điều đã thuyết phục ông rằng đã đến lúc cần có cách tiếp cận thận trọng hơn đối với sự phát triển AI: vụ hack OpenAI-HuggingFace, và thực tế là "AI đã tiến bộ nhanh hơn đáng kể" trong những tháng gần đây, đặc biệt là với "khả năng ngày càng tăng trong việc tự xây dựng thế hệ AI tiếp theo".
"Chúng ta phải làm chậm tốc độ cải thiện khả năng của các mô hình AI", Amodei viết. "Sự tiến bộ vẫn sẽ có vẻ nhanh chóng, và chúng ta phải sử dụng khoảng thời gian có được một cách khôn ngoan."
Bước đầu tiên mà ông đề xuất liên quan đến các "đánh giá viên nội bộ" (embedded evaluators) từ các tổ chức bên thứ ba như METR — những người có thể xác minh rằng các công ty AI thực sự đang tuân thủ các cam kết về tốc độ và an toàn, đồng thời đảm bảo rằng các sự cố an toàn được báo cáo. (OpenAI gần đây đã bị chỉ trích vì không báo cáo một sự cố khi các tác nhân AI của họ chiếm quyền kiểm soát một diễn đàn wiki của Đức.)
Amodei so sánh những đánh giá viên này với các cơ quan quản lý được cài cắm vào đội ngũ nhân viên ngân hàng, và ông cho biết việc mời họ vào là "điều mà Anthropic đang đơn phương cam kết (và kêu gọi các chính phủ yêu cầu các công ty tiên phong khác thực hiện tương tự)". Điều đó có nghĩa là cấp cho các đánh giá viên thẻ nhân viên, bàn làm việc, máy tính xách tay và cung cấp quyền truy cập "gần như tương đương với những gì các nhóm đánh giá rủi ro nội bộ có", ngoại trừ các trường hợp được pháp luật hoặc hợp đồng quy định.
Tiếp theo, Amodei kêu gọi các công ty AI hàng đầu "trong các quốc gia dân chủ" phối hợp thiết lập "các tiêu chuẩn an toàn chung cũng như giới hạn về tốc độ phát triển AI không kiểm soát".
Sự phối hợp như vậy có vẻ khó xảy ra, cả do sự hiềm khích rõ ràng giữa Altman và Amodei, cũng như vì các công ty của họ được cho là lo ngại rằng việc tạm dừng có phối hợp có thể dẫn đến sự giám sát về chống độc quyền. Amodei đã ám chỉ đến mối lo ngại đó trong bài đăng của mình, viết rằng "vì lý do chống độc quyền, chính phủ Mỹ nên làm trung gian hoặc ít nhất là tạo điều kiện cho các cuộc thảo luận này — họ không cần phải tham gia, nhưng cần phải ban hành một sự miễn trừ hẹp cho một số loại thảo luận về an toàn nhất định".
Amodei cũng thừa nhận bóng ma về sự thống trị AI của Trung Quốc, vốn thường được đưa ra như một lập luận chống lại việc làm chậm sự phát triển. Nhưng ông cho rằng nếu chính phủ Mỹ và các công ty công nghệ thực hiện các bước như từ chối bán chip mạnh hoặc thiết bị sản xuất bán dẫn cho các công ty Trung Quốc, cũng như trấn áp việc chưng cất mô hình (model distillation), họ có thể "làm chậm sự tiến bộ của Trung Quốc đủ để nới rộng đáng kể khoảng cách dẫn đầu của Mỹ trong 3–5 năm tới".
Cuối cùng, Amodei kêu gọi "sự phối hợp toàn cầu", nơi Hoa Kỳ và các đồng minh "cố gắng phối hợp với các chính phủ độc tài, trong phạm vi có thể". Amodei cho biết điều này có nghĩa là "hợp tác với Trung Quốc", và ông thừa nhận rằng có "những giới hạn rõ rệt về những gì có thể đạt được", nhưng ông vẫn gợi ý rằng có thể có cơ hội cho các thỏa thuận, ngay cả khi đó chỉ là "cấm một số mục đích sử dụng AI hẹp và rõ ràng là nguy hiểm, chẳng hạn như sử dụng AI để sản xuất vũ khí sinh học hoặc cho phép người dùng làm điều đó".
Với việc Amodei từng sẵn sàng thừa nhận những mối nguy hiểm tiềm tàng của AI, và với sự cởi mở tương đối của công ty đối với một số hình thức quản lý, một số người ủng hộ AI đã chỉ trích ông là một kẻ bi quan (doomer) có những bình luận góp phần gây ra phản ứng dữ dội đối với AI hiện nay. Đáp lại, Amodei cho biết ông đã cố gắng đưa ra một "quan điểm cân bằng" và lập luận rằng phản ứng dữ dội này "về cơ bản là một cuộc khủng hoảng niềm tin", khi mọi người trở nên hoài nghi về các công ty công nghệ, ngành công nghệ và chính phủ.
Các nhà phê bình trong ngành cũng tỏ ra hoài nghi về những cảnh báo AI mang tính tận thế này, cho rằng chúng là sự xao nhãng khỏi những tác hại mà công nghệ này đang gây ra.
Ví dụ, nhà báo Brian Merchant viết rằng ông vẫn chưa thấy "một tài liệu đáng tin cậy, từng bước về việc chính xác làm thế nào AI có thể chuyển từ việc tự cải thiện đệ quy sang việc giết chết từng con người trên hành tinh"; ông cũng gợi ý rằng các đề xuất tương tự như của Amodei "có khả năng chỉ phục vụ cho Anthropic và OpenAI; đó chính là bộ mặt của sự chiếm dụng quy định (regulatory capture) trong thực tế".
Trong bài đăng mới của mình, Amodei viết rằng ông vẫn "tin rằng AI có thể cải thiện đáng kể chất lượng cuộc sống của con người".
"Mong muốn đạt được những lợi ích này của tôi vẫn không hề suy giảm", ông nói. "Nhưng những lợi ích đó sẽ chỉ đạt được nếu chúng ta xây dựng công nghệ theo đúng cách, và — miễn là chúng ta sử dụng thời gian có được một cách hiệu quả — thì việc dành sự quan tâm đặc biệt để làm đúng ngay từ đầu là rất xứng đáng."
Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể nhận được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập trong biên tập của chúng tôi.
Anthony Ha là biên tập viên cuối tuần của TechCrunch. Trước đây, ông từng làm phóng viên công nghệ tại Adweek, biên tập viên cao cấp tại VentureBeat, phóng viên chính quyền địa phương tại Hollister Free Lance và phó chủ tịch phụ trách nội dung tại một công ty đầu tư mạo hiểm. Ông hiện sống tại thành phố New York.
Bạn có thể liên hệ hoặc xác minh thông tin từ Anthony bằng cách gửi email đến [email protected].
Xem tiểu sử

Bài viết được AI dịch và tổng hợp tự động từ TechCrunch: AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.