TechCrunch: AI
85

Tin ngành

Google DeepMind thành lập Viện nghiên cứu DeepMind, mở rộng thảo luận về AGI với 4 bài báo đầu tiên

(giờ Việt Nam)

Tóm tắt AI

Google DeepMind vừa ra mắt Viện nghiên cứu DeepMind dưới sự dẫn dắt của các chuyên gia hàng đầu nhằm thúc đẩy các góc nhìn đa chiều về trí tuệ nhân tạo tổng quát (AGI), khởi đầu bằng việc công bố bốn nghiên cứu chuyên sâu.

Bản dịch AI

Google DeepMind launches institute to widen the AGI debate

Các nhà nghiên cứu tại Google và Google DeepMind đã ra mắt DeepMind Institute vào thứ Tư nhằm thúc đẩy các cuộc thảo luận xoay quanh trí tuệ nhân tạo tổng quát (AGI). Viện này có các giám đốc bao gồm đồng sáng lập DeepMind Shane Legg, giám đốc điều hành Google James Manyika và chủ tịch Google DeepMind Demis Hassabis, trong đó Legg đảm nhiệm vai trò biên tập viên quản lý.

Viện mới này hướng tới việc làm nổi bật những quan điểm khác biệt giữa Google, Google DeepMind và cộng đồng nghiên cứu toàn cầu rộng lớn hơn về AGI. Thông báo cho biết: “Họ sẽ không phải lúc nào cũng đồng thuận và có khả năng sẽ thay đổi quan điểm khi có thêm dữ liệu và thông tin mới xuất hiện tại lĩnh vực đang phát triển nhanh chóng này”.

Bộ sưu tập bốn bài luận đầu tiên bao gồm nhiều chủ đề đa dạng: các chính sách kinh tế để quản lý sự gián đoạn tiềm tàng do AGI gây ra, bảo tồn khả năng suy luận có thể đọc hiểu được của mô hình, các nguyên tắc vì sự phát triển của con người và khung đánh giá cho các mô hình AI tiên tiến (frontier AI).

Một bài luận của các nhà nghiên cứu an toàn tại DeepMind là Rohin Shah và Anca Dragan lập luận rằng việc cửa sổ minh bạch của AI ngày càng thu hẹp — khả năng nhìn thấy và kiểm tra quá trình suy luận từng bước của mô hình — không phải là điều tất yếu. Khi các kiến trúc mới khiến những mô hình mạnh mẽ nhất trở nên khó giám sát hơn, các tác giả cho rằng nhà phát triển và cơ quan quản lý nên đối mặt trực tiếp với những đánh đổi về an toàn. Điều đó có thể đồng nghĩa với việc hạn chế “độ sâu tuần tự mờ đục” (opaque serial depth) — lượng tính toán tuần tự mà một mô hình có thể thực hiện mà không tạo ra dấu vết suy luận có thể đọc được — hoặc yêu cầu các nhà phát triển chứng minh rằng các hệ thống ít minh bạch hơn vẫn có khả năng giám sát tương đương.

Trong một bài luận khác, Hassabis đề xuất thành lập một cơ quan tiêu chuẩn AI tiên tiến do Hoa Kỳ dẫn đầu để đánh giá các mô hình AI hiện đại nhất. Theo khung đề xuất của ông, ban đầu các nhà phát triển sẽ tự nguyện gửi mô hình để đánh giá trong vòng 30 ngày trước khi phát hành. Một khi hệ thống đánh giá chứng minh được hiệu quả, việc vượt qua các bài kiểm tra này có thể trở thành yêu cầu bắt buộc để triển khai các mô hình tiên tiến tại Hoa Kỳ.

Ban đầu, cơ quan này sẽ thiết kế các bài đánh giá thông qua tham vấn với các công ty AI, nhưng về lâu dài sẽ phát triển các đánh giá độc lập và không công khai — được bài luận gọi là các bài kiểm tra “giữ kín” (held-out) — nhằm ngăn chặn các phòng thí nghiệm tùy chỉnh mô hình của họ để vượt qua các bài kiểm tra đã biết. Hassabis cho biết khung này có thể được “thắt chặt nếu mức độ nghiêm trọng của tình hình đòi hỏi”, bao gồm cả khả năng phối hợp làm chậm tốc độ phát triển giữa các nhà phát triển AI tiên tiến.

Các bài luận này xuất hiện trong bối cảnh cuộc tranh luận về an toàn của ngành đang chuyển dịch từ những tuyên bố quan ngại chung chung sang các đề xuất cụ thể về công khai thông tin, giám sát từ bên ngoài và, nếu các biện pháp bảo vệ không theo kịp, là sự phối hợp làm chậm tốc độ phát triển. Sự chuyển dịch này đã tăng tốc trong tuần này khi các nhà lãnh đạo trong ngành tán thành những yếu tố trong lời kêu gọi “điều tiết tốc độ” phát triển AI tiên tiến của CEO Anthropic, Dario Amodei.

Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể nhận được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập trong công tác biên tập của chúng tôi.

Event Logo
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ TechCrunch: AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.