Don't Worry About the Vase (Zvi)
85

Thủ thuật

Kiểm soát tốc độ phát triển AI: Khi nào là thời điểm thích hợp?

(giờ Việt Nam)

Tóm tắt AI

Bài viết thảo luận về tính cấp thiết và thời điểm hợp lý để áp dụng các biện pháp kiểm soát tốc độ phát triển AI (Pacing the Frontier), nhằm đảm bảo sự an toàn trước khi công nghệ vượt tầm kiểm soát.

Bản dịch AI

The Pacing of the Frontier

Sau bức thư kêu gọi chúng ta chuẩn bị cho khả năng "Pace the Frontier" (điều tiết tốc độ phát triển tiên phong), đã có rất nhiều cuộc thảo luận về việc khi nào thì việc điều tiết này là thận trọng, và liệu việc chuẩn bị để thực hiện điều đó có hợp lý hay không.

Vấn đề này hiện đã được làm rõ hơn bởi các sự kiện xoay quanh việc OpenAI huấn luyện các mô hình trong nhiều tháng trong khi họ có quyền truy cập vào một bảng tin chung trên thực tế, điều này chỉ bị phát hiện sau vụ hack HuggingFace bởi các mô hình AI của OpenAI trong một đợt đánh giá an ninh mạng. Khi chúng ta tìm hiểu thêm về sự việc đó, rất nhiều người đã trở nên lo ngại hơn nhiều, điều này là hoàn toàn dễ hiểu nếu xét đến những gì họ từng tin trước đây về độ khó của việc căn chỉnh (alignment), về trạng thái năng lực, cũng như về mức độ giám sát vận hành, cơ sở hạ tầng, an toàn và văn hóa an toàn tại các phòng thí nghiệm tiên phong.

Bài viết này sẽ không đi sâu vào chi tiết của sự cố đó. Nó coi đó là bối cảnh cần ghi nhớ và chủ yếu bao gồm các quan điểm từ trước buổi nói chuyện tại Black Hat. Bài viết này ban đầu được lên lịch vào thứ Sáu nhưng đã bị hoãn lại.

Rất nhiều bất đồng về nhu cầu điều tiết tốc độ gắn liền với những kỳ vọng về tốc độ phát triển năng lực mặc định. Như tôi đã viết gần đây trong "The Three AI Pills", những bất đồng chân thành về chính sách AI thường bắt nguồn từ những bất đồng về tốc độ tiến bộ dự kiến và những gì chúng ta kỳ vọng các AI tương lai sẽ có thể làm được.

Nguy hiểm đấy, Will Robinson.

Tiến bộ Nhanh và Chậm.

Các tuyên bố ủng hộ việc Điều tiết Tốc độ Tiên phong.

Không ai nắm quyền kiểm soát.

Điều tiết Tốc độ Tiên phong.

Tạm dừng Tốc độ Tiên phong.

Thượng nghị sĩ Sanders yêu cầu Tạm dừng.

Sự thận trọng vừa phải.

Mọi chuyện leo thang nhanh chóng.

Nếu bạn đang làm về Căn chỉnh thông thường (Mundane Alignment), hãy chuyển sang Căn chỉnh có thể mở rộng (Scalable Alignment).

Tăng tốc.

Hết tốc lực.

Biệt đội cảm tử.

Chuẩn bị điều chỉnh tốc độ của bạn.

Cũng có những bất đồng về việc một mức độ năng lực nhất định sẽ nguy hiểm đến mức nào, hoặc nó sẽ tác động vật lý đến thế giới ra sao, và bất đồng về những lựa chọn chúng ta có, bản chất của các cơ chế phối hợp hoặc can thiệp của chính phủ, cũng như việc cân bằng các giá trị thiêng liêng khác nhau. Thông thường, mọi người chỉ nhìn thấy đúng một nửa của một sự đánh đổi quan trọng.

Lý do chính khiến mọi người thường chỉ nhìn thấy một nửa của những sự đánh đổi quan trọng như vậy là vì họ dự đoán tiến bộ AI sẽ rất ít, đến mức việc giảm thiểu rủi ro hiện hữu hay lo lắng về việc con người mất kiểm soát là không cần thiết.

Hoặc họ dự đoán tiến bộ AI sẽ rất lớn, đến mức việc giảm thiểu các rủi ro hiện hữu và thảm khốc cũng như duy trì quyền kiểm soát của con người phải là ưu tiên hàng đầu, và điều đó nhất thiết có nghĩa là một nhóm người nào đó phải cùng nhau lựa chọn và vạch ra, theo một cách nào đó, một lộ trình có chủ đích thông qua không gian nhân quả hướng tới những kết quả cho phép chúng ta tồn tại.

Đúng vậy, điều đó nhất thiết có nghĩa là cho phép một nhóm người có một cơ chế tập thể để vạch ra một số khía cạnh trong lộ trình của Trái đất thông qua không gian nhân quả, và đúng là có những lý do để lo lắng về điều đó, nhưng đó là lý do tại sao chúng ta nên nỗ lực tìm ra cách tốt nhất để thực hiện việc này.

Những người phản đối bức thư "Pacing the Frontier" không muốn "chậm lại" mà thay vào đó muốn AI đi "nhanh", nhưng tầm nhìn của họ về sự nhanh chóng, dù rất nhanh theo tiêu chuẩn lịch sử, lại không thực sự nhanh đến thế.

Những người đã ký vào bức thư "Pacing the Frontier" chủ yếu muốn AI phát triển ít nhất là nhanh bằng phe đối lập. Điều họ muốn tránh là AI phát triển siêu siêu cực kỳ nhanh.

Daniel Eth (AI Safety): Đây là cách tôi diễn giải các từ ngữ:

Tạm dừng (Pause): đạp phanh.

Điều tiết (Pace): đừng gắn một động cơ tên lửa khổng lồ vào phía sau chiếc xe, thứ sẽ tăng tốc chúng ta từ 65 dặm/giờ lên 10.000 dặm/giờ, ít nhất là trừ khi chúng ta có thể tắt nó đi. Ngoài ra, đừng vô hiệu hóa phanh.

Hầu như tất cả những người ký vào bức thư đều muốn có chatbot, bác sĩ, khoa học tốt hơn và các hình thức phổ biến khác. Họ không muốn siêu trí tuệ và một điểm kỳ dị (singularity) vào năm 2027.

Nick: rất nhiều người trong phe phản đối muốn chatbot và bác sĩ tốt hơn, trong khi rất nhiều người trong phe ủng hộ kỳ vọng những thế giới điên rồ hơn nhiều trong ngắn hạn và muốn chúng đến trong khoảng thời gian ngắn hơn một chút khi chúng ta đã tìm ra cách kiểm soát những thứ này tốt hơn. Có rất nhiều sự chồng chéo.

làm thế nào để thực hiện thì không biết, và làm thế nào để đo giới hạn tốc độ cũng không biết, nhưng tôi cảm thấy cách đặt vấn đề này tránh được một số vấn đề của việc "tạm dừng", vốn cũng có những câu hỏi tương tự.

Dean W. Ball: Đây là điều mà hầu hết những người tôi biết đã ký vào bức thư "điều tiết" (bao gồm cả tôi) đều nghĩ. Sự chậm lại mà chúng tôi nghĩ đến chỉ là tạm thời, và hướng tới một tốc độ tiến bộ vẫn nhanh hơn nhiều so với tốc độ hiện nay.

Augmented Fifth: Hôm nay là ngày 19 tháng 12, học sinh đã nghỉ học và quà Giáng sinh đã đặt dưới gốc cây. "Hãy đợi đến tháng Hai" sẽ không thể thuyết phục được lũ trẻ.

Tôi trích dẫn câu cuối đó vì những gì đang xảy ra là những người đang lập luận chống lại bức thư "Pacing the Frontier" đang nói rằng họ sẽ không đợi đến tháng Hai và đòi hỏi phải có quà vào ngày 25 tháng 12, và tốt nhất là họ nên nhận được khẩu súng BB đó.

Trong khi đó, những người ký bức thư đang nói rằng có lẽ chúng ta nên đợi ít nhất đến ngày mai trước khi đặt thêm quà vì trong nhà không còn chỗ nữa, cộng với việc có lẽ hãy giữ cho đồ chơi ở mức hợp lý, và chỉ mua cho bạn khẩu súng BB có thể làm hỏng mắt bạn thôi chứ không phải AK-47, vũ khí hạt nhân chiến thuật hay cái đầu dò Von Neumann quyến rũ đó.

Một bình luận mạnh mẽ khác từ một trong những người đã ký bức thư "Pacing the Frontier":

Drake Thomas (Anthropic): Rất vui khi đã ký vào bức thư "Pacing the Frontier"; sự tồn tại của nó mang lại cho tôi rất nhiều hy vọng về sự sống còn của nhân loại!

Tôi tán thành bức thư như đã viết (và nghĩ rằng, với những hạn chế hiện tại, nó có lẽ gần như là tốt nhất có thể cho mức độ đồng thuận này), nhưng có một số điểm tôi khác biệt về tông giọng hàm ý của nó:

(1) AI không chỉ "không được đảm bảo" sẽ tạo ra một tương lai tốt đẹp hơn đáng kể, mà tỷ lệ thất bại còn cao đến mức đáng sợ: Tôi nghĩ* có khoảng 40% khả năng chúng ta sẽ nhận kết quả tệ hại tương đương với sự tuyệt chủng của con người hoặc tệ hơn, và 30% khả năng chúng ta có một tương lai mà dù chứa đựng một số điều tốt đẹp, vẫn thiếu hụt trầm trọng so với những gì một nền văn minh khôn ngoan hơn có thể đạt được (ví dụ: <5% giá trị của một tương lai thực sự tuyệt vời).

(2) Tôi không thực sự tán thành cảm giác "hiện thực hóa tiềm năng của AI"; tôi nghĩ động lực cấp bách và ngay lập tức hơn nhiều là "tránh những kết quả thảm khốc từ AI sẽ giết chết rất nhiều người". (Tiềm năng cũng rất quan trọng, tất nhiên, nhưng tôi nghĩ hầu hết các lý thuyết đạo đức sẽ coi đó là tầm quan trọng thứ yếu khi rủi ro cao như thế này và dù sao thì cũng chẳng có gì làm được nhiều hơn là trì hoãn tạm thời tiềm năng đó.)

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Don't Worry About the Vase (Zvi). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.