IT Home
82

Tin ngành

Anthropic nâng cấp Claude Fable 5: Giảm 85% tỷ lệ từ chối nhầm trong lĩnh vực sinh học

(giờ Việt Nam)

Tóm tắt AI

Anthropic đã tinh chỉnh bộ lọc an toàn trên Claude Fable 5, giúp giảm 85% các trường hợp từ chối nhầm khi trả lời câu hỏi sinh học, đồng thời cải thiện khả năng phân biệt giữa yêu cầu vô hại và rủi ro cao.

Bản dịch AI

Theo tin từ IT ngày 8 tháng 8, công ty khởi nghiệp trí tuệ nhân tạo Anthropic của Mỹ hôm qua đã đăng tải bài viết cho biết, công ty đang cập nhật cơ chế bảo mật sinh học cho mô hình Claude Fable 5 nhằm giảm đáng kể tình trạng chặn nhầm. Giờ đây, khi người dùng Fable 5 đặt các câu hỏi liên quan đến sinh học, hệ thống sẽ ít xảy ra tình trạng từ chối phản hồi (downgrade) hơn.

Theo dữ liệu thử nghiệm chính thức từ Anthropic, bản cập nhật này đã giúp giảm 85% tình trạng từ chối phản hồi đối với các câu hỏi liên quan đến sinh học, giúp Fable 5 hiện có thể xử lý phạm vi nhiệm vụ sinh học rộng hơn.

Anthropic cho biết, một số người dùng có ý đồ xấu đã sử dụng mô hình Fable 5 để thực hiện các hoạt động rủi ro cao như nghiên cứu vũ khí sinh học. Do đó, để ngăn chặn hiện tượng này, công ty đã thiết lập các bộ phân loại an toàn (safety classifiers) chuyên biệt cho Claude, nhằm phát hiện xem người dùng có đang yêu cầu Fable 5 thực hiện các nhiệm vụ sinh học được bảo vệ hay tạo ra nội dung độc hại hay không.

Hiện tại, Anthropic đã điều chỉnh cơ chế hoạt động của các bộ phân loại an toàn, giúp chúng phân biệt chính xác hơn giữa các câu hỏi vô hại và các câu hỏi có rủi ro cao.

Tuy nhiên, để phòng ngừa các rủi ro AI tiềm ẩn, Fable 5 vẫn sẽ hạn chế các yêu cầu liên quan đến nghiên cứu sinh học chuyên sâu và phát triển dược phẩm.

AnthropicClaudeAn toàn AISinh họcAI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.