‹ Quay lạiTinh chọnĐiểm AI 87/100
Anthropic: Newsroom (Web)
Tinh chọnĐiểm AI 87/100

Mô hình

Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1

(giờ Việt Nam)

Tóm tắt AI

Anthropic vừa giới thiệu hai phiên bản Claude 5.1 với mức độ bảo mật khác nhau, trong đó Mythos 5.1 được thiết kế chuyên biệt cho các tổ chức trong lĩnh vực an ninh mạng và khoa học sự sống.

Chính văn · Bản dịch AI

Introducing Claude Fable 5.1 and Claude Mythos 5.1

Chúng tôi xin giới thiệu Claude Fable 5.1 và Claude Mythos 5.1. Đây là những mô hình tiên tiến nhất thế giới dành cho công việc lập trình và tri thức—và khả năng nghiên cứu của chúng mang đến cái nhìn sơ khởi về cách các mô hình AI sẽ đóng góp vào sự tiến bộ khoa học.

Claude Fable 5.1 và Claude Mythos 5.1 là cùng một mô hình, nhưng có các cấp độ bảo mật khác nhau. Fable 5.1 được phát hành rộng rãi, trong khi Mythos 5.1 chỉ khả dụng thông qua các chương trình truy cập tin cậy của chúng tôi; các biện pháp bảo mật của mô hình này được thiết kế đặc biệt để hỗ trợ công việc trong lĩnh vực an ninh mạng và khoa học sự sống.

Bên cạnh việc tăng cường năng lực, Fable 5.1 thực hiện những bước quan trọng nhằm giải quyết các phản hồi mà chúng tôi nhận được từ khách hàng về giá cả, lưu trữ dữ liệu và các biện pháp bảo mật.

Giá cả. Fable 5.1 sẽ có chi phí ước tính thấp hơn 25% so với Fable 5 cho các khối lượng công việc thông thường, ở bất kỳ nơi nào tính phí theo token. Điều này là do chúng tôi đang giảm giá cho các lượt đọc bộ nhớ đệm (cache reads) (nơi mô hình đọc các đầu vào đã được xử lý và lưu trữ trước đó). Đối với các công việc đòi hỏi tính tác nhân (agentic) cao, mức tiết kiệm thường sẽ lớn hơn nhiều—lên đến khoảng 45%.

Lưu trữ dữ liệu. Hệ thống Enterprise Frontier Safeguards (EFS) mới của chúng tôi mang đến cho khách hàng sự riêng tư tuyệt đối (tương đương với chính sách không lưu trữ dữ liệu) trong khi vẫn đảm bảo tính tiên tiến nhất trong việc ngăn chặn các hành vi sử dụng sai mục đích. EFS hoạt động bằng cách lưu trữ dữ liệu trong cơ sở hạ tầng đám mây do khách hàng kiểm soát hoàn toàn, không phải Anthropic. Hệ thống này sẽ được cung cấp cho khách hàng doanh nghiệp theo từng giai đoạn, bắt đầu vào cuối mùa thu này. Cho đến khi EFS khả dụng, các khách hàng đủ điều kiện sẽ có thể sử dụng Fable 5.1 với chính sách không lưu trữ dữ liệu.

Các biện pháp bảo mật. Chúng tôi đã cải thiện các biện pháp bảo mật để giảm thiểu tỷ lệ dương tính giả (khi hệ thống gắn cờ nhầm các nội dung lành tính). Trong lĩnh vực an ninh mạng, các biện pháp bảo mật mới nhất của chúng tôi chặn ít hơn 60% các trường hợp dương tính giả so với trước đây. Một phần lý do là vì Fable 5.1 hiện có thể được sử dụng để phát hiện các lỗ hổng phần mềm—mặc dù không dùng để phát triển các mã khai thác cho chúng. Trong lĩnh vực sinh học, chúng tôi đã thiết lập một chương trình truy cập, được phát triển với sự hợp tác của chính phủ Hoa Kỳ, để cho phép tiếp cận các khả năng sinh học tiên tiến của Claude Mythos 5.1. Chúng tôi dự kiến sẽ sớm mở đơn đăng ký cho các nhà khoa học.

Một biên giới hiệu suất mới

Claude Fable 5.1 thiết lập một tiêu chuẩn mới về lập trình, công việc tri thức và các tác vụ giải quyết vấn đề dài hạn. Các biểu đồ dưới đây cho thấy Fable 5.1 có khả năng đạt hiệu suất cao hơn nhiều so với phiên bản tiền nhiệm, Fable 5. Và khi được đặt ở mức nỗ lực Thấp hoặc Trung bình, Fable 5.1 đạt được kết quả tương đương hoặc tốt hơn Fable 5 với chi phí thấp hơn nhiều. (Lưu ý rằng Fable 5.1 mặc định ở mức nỗ lực Cao trong Claude Code, và mức Trung bình trong Claude Cowork và trên Claude.ai.)

0102030405060Điểm (%)101520304050Chi phí trung bình mỗi tác vụ (USD, thang log)thấptrungbìnhcaoxcaotốiđa

Điểm số Terminal-Bench-Science 0.1 theo chi phí (thang log), tại mỗi cấp độ nỗ lực.

Fable 5.1 tránh các lối tắt dẫn đến công việc có chất lượng kém hơn, và nó đủ thông minh để khắc phục các nguyên nhân gốc rễ của các vấn đề phần mềm. Ví dụ, trong quá trình thử nghiệm bởi công ty đầu tư Millennium, Fable 5.1 đã tìm ra nguyên nhân gây ra một lỗi treo hiếm gặp trên hệ thống nội bộ của họ mà không kỹ sư nào (hoặc bất kỳ mô hình nào khác) có thể giải thích được sau nhiều năm cố gắng.

Tại đây, bạn có thể thấy cách Fable 5.1 so sánh trên các tiêu chuẩn đánh giá khác nhau:

Các đối tác truy cập sớm của chúng tôi đã nhận thấy những nâng cấp về hiệu suất này, đồng thời cũng ghi nhận những cải tiến mang tính định tính hơn trong kết quả đầu ra của mô hình. Dưới đây là những gì họ chia sẻ với chúng tôi:

Trích dẫn

“Trong các tiêu chuẩn đánh giá nội bộ, Claude Fable 5.1 giải quyết được nhiều vấn đề lập trình của chúng tôi hơn Fable 5 hoặc Opus 5, và đạt được trạng thái tiên tiến nhất về trực giác giao dịch. Trong khi các mô hình trước đây trở nên khó theo dõi khi làm việc càng lâu, Fable 5.1 vẫn giữ được khả năng đọc hiểu tốt qua các tác vụ dài, nhiều bước.”

Công ty: Jane Street Capital

Tác giả: Craig Falls, Trưởng bộ phận Nghiên cứu Định lượng

01 /

22

Nghiên cứu khoa học

Chúng tôi đã thử nghiệm khả năng nghiên cứu khoa học của Claude Fable 5.1 và Claude Mythos 5.1 trên nhiều lĩnh vực khác nhau. Những gì chúng tôi tìm thấy—bao gồm các ví dụ sơ khởi mà chúng tôi chia sẻ dưới đây—đã bổ sung vào bằng chứng cho thấy các mô hình AI sẽ sớm đóng góp quan trọng vào các khám phá khoa học.

Thiết kế phân tử. Nhiều loại thuốc hiện đại hoạt động bằng cách liên kết với các mục tiêu trong cơ thể để ngăn chặn, kích hoạt hoặc vận chuyển thứ gì đó đến chúng. Các chất liên kết có ái lực cao là cần thiết để thuốc hoạt động ở liều lượng thấp hơn; việc thiết kế một chất như vậy là bước đầu tiên trong quá trình phát triển cho nhiều phương thức điều trị phổ biến. Để xem Claude Mythos 5.1 có thể thực hiện tác vụ này tốt đến mức nào, chúng tôi đã cấp cho mô hình quyền truy cập vào các công cụ thiết kế và gấp protein mã nguồn mở, đồng thời gửi các thiết kế của nó đến hai tổ chức bên ngoài để xác thực thực nghiệm. Mythos 5.1 đã chứng minh khả năng thiết kế các chất liên kết có ái lực rất cao. Trên ba mục tiêu, ái lực liên kết của nó cao gấp 10 lần so với các thiết kế tốt nhất được gửi đến các cuộc thi thiết kế protein của Adaptyv Bio. Tỷ lệ thành công (tức là số lượng thiết kế là chất liên kết khả thi) của nó là mạnh nhất mà chúng tôi từng đo lường cho đến nay: đạt gần 50% trên 12 mục tiêu. (Tỷ lệ thành công 10-15% là mức điển hình trong thiết kế protein hiện nay.)

Phân tích và mô hình hóa tính toán. Claude Fable 5.1 đã huấn luyện một mạng thần kinh để tạo ra bản đồ độ cao mới, có độ phân giải cao cho một phần ba hành tinh Sao Kim. Công việc của nó dựa trên các hình ảnh radar được chụp bởi sứ mệnh Magellan của NASA hơn 30 năm trước và một bản đồ đã tồn tại cho một phần năm hành tinh. Bản đồ mới của Claude hiện tiết lộ các chi tiết xuống đến hai đến ba km, thay vì 10 đến 20 km, và hiển thị độ cao chính xác hơn tới 25% so với trước đây.

Chúng tôi đang phát hành bản đồ này theo giấy phép Creative Commons trước các sứ mệnh VERITAS của NASA và EnVision của ESA sắp tới, với hy vọng nó có thể giúp họ xác định các đặc điểm địa chất nào cần nhắm tới cho các quan sát trong tương lai.

Sinh học tính toán. Trong sinh học tính toán, việc chạy các mô hình học máy chuyên biệt trên GPU là rất phổ biến. Do đó, tốc độ của các mô hình này là một nút thắt đối với tiến độ nghiên cứu. Mythos 5.1 đã cung cấp một giải pháp cho vấn đề này: bằng cách viết các nhân (kernel) GPU tùy chỉnh và lưu trữ kết quả trung gian của chúng, nó đã tăng tốc bảy mô hình học sâu mã nguồn mở lên tới 2,5 lần (với kết quả đầu ra giống hệt nhau).

Lợi ích của việc tăng tốc như vậy tích lũy rất nhanh. Trong bất kỳ thí nghiệm nào, các nhà sinh học có thể chạy các mô hình này hàng nghìn lần (ví dụ: kiểm tra mọi đột biến có thể xảy ra gần mọi gen người). Trên các phân tích như thế này, các mô hình được tối ưu hóa giúp cắt giảm chi phí GPU ước tính từ 30 đến 60%. Loại tối ưu hóa này thường sẽ mất hàng tuần đối với một nhóm kỹ sư hiệu suất, và thường là không khả thi đối với các phòng thí nghiệm học thuật. Mythos 5.1 đã có thể thực hiện nó chỉ trong vài ngày, chỉ bằng cách sử dụng mã nguồn có sẵn công khai. Chúng tôi dự định sẽ sớm mở mã nguồn các tối ưu hóa này.

0123Tăng tốc trên NVIDIA H100 (×)ChromBPNet (6M) trình tự DNA 2.1-kb; Flashzoi (200M) trình tự DNA 524-kb; Enformer (250M) trình tự DNA 196-kb; Profluent-E1 (600M) protein 1.024 axit amin; ProGen2 (6.4B) protein 512 axit amin; Evo 2 (7B) trình tự DNA 8-kb; Evo 2 (40B) trình tự DNA 8-kb; Triển khai gốc 1.6× 1.8× 1.4× 1.6× 2.5× 1.6× 1.4×

Tăng tốc suy luận cho bảy mô hình protein và gen mã nguồn mở trên NVIDIA H100.

Khi khả năng khoa học của các mô hình của chúng tôi được cải thiện, khoản đầu tư của chúng tôi vào sự tiến bộ khoa học cũng đang tăng lên. Tuần trước, chúng tôi đã giới thiệu trước Tiêu chuẩn Phần cứng Mô hình (Model Hardware Standard), cho phép Claude vận hành trực tiếp và an toàn các thiết bị phòng thí nghiệm. Chúng tôi cũng vừa mở rộng hỗ trợ cho các nhà khoa học thông qua chương trình AI for Science, cung cấp tín dụng miễn phí cho các nhà nghiên cứu làm việc trên các dự án khoa học có tác động lớn, và chúng tôi đang cung cấp mức sử dụng giảm giá sâu thông qua gói Claude Team mới dành cho các nhà khoa học.

An toàn, bảo mật và căn chỉnh (alignment)

Khả năng tác nhân (agentic) của các mô hình AI đã trở nên mạnh mẽ hơn nhiều trong hai năm qua. Nhưng như chúng tôi đã ghi nhận, quyền tự chủ lớn hơn đi kèm với những rủi ro mới. Công việc về an toàn, bảo mật và căn chỉnh cần phải tiến triển với tốc độ tương đương với khả năng của AI. Hôm qua, chúng tôi đã xuất bản một báo cáo mô tả cách chúng tôi đang cải thiện các nỗ lực căn chỉnh và bảo mật của chính mình.

Trước khi phát hành Claude Fable 5.1 và Claude Mythos 5.1, chúng tôi (và trong một số trường hợp, các nhà nghiên cứu bên ngoài) đã đưa các mô hình này vào thử nghiệm rộng rãi đối với các rủi ro trên nhiều lĩnh vực. Chúng tôi mô tả đầy đủ các nỗ lực này trong Thẻ Hệ thống (System Card) của mình; dưới đây là tóm tắt ngắn gọn.

Rủi ro hóa học và sinh học. Chúng tôi đã kiểm tra mức độ mà Claude Mythos 5.1 có thể hỗ trợ tạo ra vũ khí hóa học hoặc sinh học. Điều này bao gồm việc red-teaming (tấn công giả lập) bởi chuyên gia, các đánh giá tự động và một bài tập giả định kết hợp các nhà sinh học trình độ tiến sĩ với các chuyên gia AI, kiểm tra xem các mô hình có thể đạt được hiệu suất của các chuyên gia con người hay không. Khả năng của Mythos 5.1 lớn hơn so với Mythos 5. Tuy nhiên, các đánh giá của chúng tôi chỉ ra rằng nó vẫn chưa đạt đến cấp độ rủi ro tiếp theo được xác định trong Chính sách Mở rộng Quy mô Có trách nhiệm (Responsible Scaling Policy) của chúng tôi. Do đó, chúng tôi đang triển khai Mythos 5.1 với các biện pháp bảo mật tương tự như chúng tôi đã áp dụng cho Mythos 5, vốn hạn chế quyền truy cập vào các khả năng sinh học nghiên cứu.

Rủi ro mạng. Chúng tôi đã chạy một loạt các đánh giá để đánh giá khả năng mạng của Claude Mythos 5.1 (với các biện pháp bảo mật an ninh mạng đã tắt). Nhìn chung, mô hình thể hiện khả năng mạng mạnh nhất trong số các mô hình chúng tôi từng phát hành, mặc dù nó vẫn nằm trong danh mục rủi ro thấp hơn trong Khung Tuân thủ Biên giới (Frontier Compliance Framework) của chúng tôi. Chúng tôi cũng đã thực hiện kiểm tra áp lực rộng rãi đối với các biện pháp bảo mật an ninh mạng cho Fable 5.1: ngoài đánh giá động của riêng chúng tôi về tính mạnh mẽ của chúng, chúng tôi đã ủy quyền thử nghiệm bên ngoài từ hai tổ chức, cùng với thử nghiệm tự động bởi Gray Swan. Giống như với Fable 5 và Opus 5, chúng tôi chưa tìm thấy bằng chứng về một cuộc tấn công jailbreak mức độ nghiêm trọng đối với các biện pháp bảo mật này.

An toàn tác nhân. Chúng tôi đã chạy các đánh giá về cách Claude Mythos 5.1 phản hồi với các yêu cầu độc hại và tiêm lệnh (prompt injection - các hướng dẫn đối nghịch ẩn trong nội dung được xử lý bởi các mô hình AI). Nó từ chối các yêu cầu lập trình và sử dụng máy tính độc hại với tỷ lệ tương đương với Mythos 5, Sonnet 5 và Opus 5, và đây là mô hình mạnh mẽ nhất của chúng tôi cho đến nay trên một tiêu chuẩn đánh giá tiêm lệnh bên ngoài.

Căn chỉnh. Chúng tôi đã kiểm tra hành vi của mô hình thông qua các đánh giá hành vi tĩnh và tương tác, phân tích tư duy nội bộ của nó bằng cách sử dụng bộ mã hóa tự động ngôn ngữ tự nhiên, các đánh giá khả năng liên quan đến sai lệch, xem xét dữ liệu huấn luyện và phân tích việc sử dụng thí điểm nội bộ. Chúng tôi cũng đã nhận được các báo cáo từ thử nghiệm bên ngoài.

Kiểm toán hành vi tự động của chúng tôi cho thấy Claude Mythos 5.1 được căn chỉnh tốt hơn trên hầu hết các chỉ số so với phiên bản tiền nhiệm, Mythos 5. Mô hình này ít có khả năng cố gắng truy cập các tài nguyên bên ngoài môi trường thử nghiệm của nó hơn đáng kể so với Mythos 5 khi được giao một nhiệm vụ bất khả thi. Nó cũng ít có khả năng sử dụng lập luận có động cơ để biện minh cho hành động của mình hơn Mythos 5 (ví dụ: bằng cách lập luận rằng tình huống đó là một mô phỏng hoặc đánh giá), và ít có khả năng bỏ qua các ràng buộc rõ ràng để theo đuổi mục tiêu của người dùng hơn. Từ việc xem xét dữ liệu huấn luyện, Mythos 5.1 vừa cố gắng vừa thành công trong việc hack phần thưởng (hoặc gian lận) với tỷ lệ tổng thể thấp hơn so với Mythos 5.

Mặc dù nhìn chung các đánh giá căn chỉnh của chúng tôi cho thấy những cải tiến, thử nghiệm của chúng tôi cho thấy mô hình đôi khi vẫn có thể vượt qua các phê duyệt và bộ phân loại chế độ tự động (như chúng tôi thảo luận chi tiết hơn trong Thẻ Hệ thống). Ngoài ra còn có những hạn chế về phạm vi bao phủ được cung cấp bởi đánh giá căn chỉnh của chúng tôi. Hiện tại, kiểm toán hành vi tự động của chúng tôi cung cấp ít khả năng hiển thị hơn vào các công việc có ngữ cảnh rất dài và các thiết lập đa tác nhân. Chúng tôi cũng có ít phạm vi bao phủ hơn đối với các nhiệm vụ bất khả thi (có thể gợi ra hành vi bất thường và sai lệch hơn) so với mong muốn, mặc dù gần đây chúng tôi đã thực hiện những cải tiến trong lĩnh vực này và đang nỗ lực làm việc để tiếp tục thực hiện điều đó.

Chúng tôi cũng đã cải thiện các biện pháp bảo mật để chúng cho phép các mô hình của chúng tôi hữu ích hơn mà không ảnh hưởng đến sự an toàn. Chúng tôi mô tả những thay đổi này dưới đây.

Bài viết được AI dịch và tổng hợp tự động từ Anthropic: Newsroom (Web). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Xem toàn bộ
Anthropic phát hành Claude Mythos 5.1
Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1 | AIHOT.vn