IT Home
92

Tin ngành

Anthropic và Accenture bắt tay đầu tư 2 tỷ USD để kiểm định an toàn AI

(giờ Việt Nam)

Tóm tắt AI

Anthropic và Accenture cam kết đầu tư 2 tỷ USD trong 5 năm tới để thiết lập quy trình kiểm định độc lập và thử nghiệm tấn công (red teaming) cho các mô hình AI tiên tiến ngay tại doanh nghiệp.

Bản dịch AI

Theo tin từ IT ngày 20 tháng 9, phòng thí nghiệm trí tuệ nhân tạo Anthropic vào thứ Sáu theo giờ địa phương đã thông báo về việc hợp tác với Accenture để tiến hành đánh giá độc lập đối với các mô hình AI tiên tiến của chính mình; hai doanh nghiệp cam kết sẽ đầu tư ít nhất 1 tỷ USD mỗi bên trong vòng 5 năm tới (Ghi chú của IT: theo tỷ giá hiện tại tương đương khoảng 6,718 tỷ Nhân dân tệ) để xây dựng các năng lực hỗ trợ cần thiết cho công việc này.

Sự hợp tác này diễn ra trong bối cảnh các doanh nghiệp nghiên cứu và phát triển AI đang phải chịu áp lực ngày càng lớn từ các cơ quan quản lý, các doanh nghiệp khác và giới nghiên cứu, khi tất cả các bên đều yêu cầu các công ty phải đảm bảo tính an toàn và độ tin cậy cho các mô hình cao cấp.

Gần đây đã xảy ra một số sự cố liên quan, bao gồm việc một số AI agent vượt ra khỏi môi trường vận hành biệt lập. Điều này làm dấy lên lo ngại rằng trong tương lai, trí tuệ nhân tạo có thể tự thúc đẩy quá trình lặp lại của chính mình với sự can thiệp tối thiểu từ con người, khiến cho hành vi của AI trở nên khó giám sát và kiểm soát hơn.

Vào thứ Bảy theo giờ địa phương, CEO của Anthropic là Dario Amodei đã kêu gọi các công ty AI làm chậm nhịp độ phát triển các mô hình tiên tiến, đồng thời mở rộng quyền truy cập hệ thống ở mức độ cao hơn cho các chuyên gia đánh giá độc lập.

Đối thủ cạnh tranh là OpenAI vào thứ Tư đã tuyên bố rằng họ sẽ định kỳ công bố các báo cáo để tiết lộ những bất thường hoặc các hành vi đáng cảnh báo xuất hiện trong mô hình, đồng thời đã công bố sáu báo cáo sự cố liên quan cùng một lúc.

Faculty, bộ phận kinh doanh AI chuyên biệt trực thuộc Accenture, sẽ dẫn dắt sự hợp tác lần này, chịu trách nhiệm đánh giá và thực hiện kiểm thử red-teaming (tấn công và phòng thủ) đối với các mô hình của Anthropic, hoàn thành việc đánh giá hiệu quả căn chỉnh (alignment), đồng thời kiểm tra các cơ chế bảo mật của mô hình.

Nguồn vốn mà hai bên đầu tư sẽ được sử dụng để hỗ trợ mô hình mà Anthropic gọi là "đánh giá tại chỗ" (embedded evaluation): các chuyên gia đánh giá độc lập sẽ làm việc trực tiếp tại nội bộ doanh nghiệp AI, với quyền truy cập hệ thống tương đương với nhân viên thông thường.

Anthropic cho biết: "Dựa trên góc nhìn này, các chuyên gia đánh giá tại chỗ có thể khảo sát tình hình vận hành thực tế của doanh nghiệp, xác minh xem doanh nghiệp có thực hiện đúng các cam kết liên quan đến an toàn hay không, đồng thời phát hiện ra những điểm mù bảo mật mà chính doanh nghiệp cũng chưa nhận thức được."

Thông báo cũng bổ sung rằng các chuyên gia đánh giá có thể báo cáo các loại sự cố bảo mật, cung cấp cho công chúng những phân tích chi tiết hơn, làm rõ các lợi ích cũng như rủi ro tiềm ẩn mà AI mang lại.

Anthropic và Accenture dự kiến trong tương lai sẽ liên kết với các tổ chức đánh giá khác cùng các nhà phát triển AI để triển khai công việc liên quan theo mô hình tương tự.

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.