Sản phẩm
Anthropic nới lỏng kiểm duyệt sinh học trên Claude 3.5 Sonnet, nhưng vẫn giữ rào chắn an toàn
(giờ Việt Nam)
Tóm tắt AI
Anthropic đã giảm 85% tỷ lệ chặn nhầm các truy vấn sinh học trên Claude 3.5 Sonnet, cho phép người dùng thực hiện các tác vụ y tế và phân tích dữ liệu dễ dàng hơn. Tuy nhiên, các chủ đề nhạy cảm như virus học và độc chất học vẫn bị hạn chế để đảm bảo an toàn.
Bản dịch AI

Anthropic đã giảm khoảng 85% tỷ lệ cảnh báo sai (false positives) trong các bộ lọc an toàn sinh học của Fable 5. Trước đây, gần như tất cả các truy vấn về sinh học đều bị chặn và chuyển hướng sang Opus 5 với khả năng hạn chế hơn, điều này đã vấp phải sự chỉ trích gay gắt từ các nhà khoa học. Giờ đây, người dùng có thể xử lý nhiều tác vụ sinh học hơn với Fable 5, chẳng hạn như diễn giải kết quả phòng thí nghiệm, tìm hiểu các triệu chứng và trả lời các câu hỏi y tế.

Các hạn chế vẫn được áp dụng đối với những chủ đề "lưỡng dụng" (dual-use) như virus học, độc chất học và thiết kế phân tử, nơi Anthropic cho rằng Fable 5 có thể cung cấp cho những kẻ xấu các khả năng mà họ không thể tìm thấy ở nơi nào khác. Công ty cũng đang xây dựng các chương trình truy cập để các nhà nghiên cứu có thể sử dụng những tính năng bị hạn chế này trong tương lai.
Lý do của Anthropic: các rủi ro sinh học có thể khó kiểm soát hơn so với các cuộc tấn công mạng. Một loại virus khi đã phát tán thì không thể tắt đi được và các biện pháp đối phó cần nhiều thời gian. Một phân tích từ các cơ quan tình báo Hoa Kỳ, một đánh giá về các cuộc trò chuyện trên ChatGPT yêu cầu hướng dẫn chế tạo vũ khí sinh học, các cảnh báo chung từ các nhà nghiên cứu và một dự án của Stanford sử dụng AI để thiết kế các loại virus tổng hợp hoàn toàn đều cho thấy mối đe dọa này là có thật chứ không chỉ là nỗi lo lắng thường thấy của Anthropic.
Tin tức AI không thổi phồng – Được tuyển chọn bởi con người
Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia vào phần bình luận của chúng tôi.
Đăng ký ngay
Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.