Mô hình
Claude Fable/Mythos 5.1: Mô hình SOTA mới, giảm 75% phí cache và tăng 70% giới hạn token đầu ra
(giờ Việt Nam)
Tóm tắt AI
Anthropic vừa ra mắt bộ đôi mô hình Claude 5.1 với hiệu năng vượt trội, đồng thời tối ưu hóa chi phí vận hành và mở rộng đáng kể dung lượng xử lý token đầu ra cho người dùng.
Bản dịch AI
![[AINews] Claude Fable/Mythos 5.1: new SOTA model, 75% cache price cut but 70% more output tokens](https://substackcdn.com/image/fetch/$s_!-NFa!,w_1200,h_675,c_fill,f_jpg,q_auto:good,fl_progressive:steep,g_auto/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F__ss-rehost__tw-video-preview-13_2094843261470793728.jpg)
Với việc Astra cuối cùng cũng đang rục rịch chuẩn bị cho một đợt ra mắt toàn diện (sau khi @sama và @openai lại viết về nó sau một tháng tự áp đặt nhịp độ), đây là một thời điểm quen thuộc để chiếm lĩnh diễn ngôn với vòng xoay các đợt ra mắt mô hình, cùng với Grok 4.7 và Gemini Flash 3.8 cũng đang trên đường ra mắt. Nhưng có lẽ đó không phải là cách tốt nhất để nhìn nhận sự kiện ra mắt hôm nay… vốn đã thu hút hơn 12 triệu lượt xem khi cập nhật lại mô hình tốt nhất thế giới hiện nay:

Claude@claudeai
Chúng tôi xin giới thiệu Claude Fable 5.1 và Claude Mythos 5.1. Đây là những mô hình tiên tiến nhất thế giới dành cho lập trình và công việc tri thức.
6:03 CH · 1 tháng 9, 2026 · 12,8 triệu lượt xem
2,4 nghìn lượt trả lời · 6,44 nghìn lượt đăng lại · 56,7 nghìn lượt thích
Bảng điểm chuẩn đã nói lên tất cả:

Mặc dù giá mỗi token vẫn giữ nguyên như Fable/Mythos 5, nhưng giá đọc bộ nhớ đệm (cache read) đã giảm 75%... một tin tuyệt vời cho những người dùng có phiên làm việc dài/ngữ cảnh dài, tuy nhiên lại bị bù trừ bởi mức tăng 1,7 lần lượng token đầu ra theo ghi nhận từ Artificial Analysis, dẫn đến tổng chi phí thực tế trên mỗi tác vụ tăng 20% (xem tóm tắt bên dưới).
Ngoài ra, đừng quên đợt ra mắt Astra của World Labs, đây là đợt ra mắt mô hình thế giới ấn tượng nhất mà chúng ta từng thấy, và nếu vào một ngày bình thường, nó chắc chắn đã dễ dàng trở thành tiêu đề chính. Bạn có thể cập nhật tầm nhìn của Fei Fei và Justin Johnson trên podcast của chúng tôi và theo dõi từ Marble đến Astra cũng như những gì chúng tôi đã thảo luận về tiềm năng thực sự của các mô hình thế giới:
Tin tức AI từ 31/8/2026 đến 1/9/2026. Chúng tôi đã kiểm tra 12 subreddit, 544 tài khoản Twitter và không có thêm thông tin nào từ Discord. Trang web của AINews cho phép bạn tìm kiếm tất cả các số đã phát hành. Xin nhắc lại, AINews hiện là một chuyên mục của Latent Space. Bạn có thể chọn nhận hoặc hủy nhận email theo tần suất!
Tin nổi bật: Phát hành Fable 5.1 và Mythos 5.1 cùng các phản ứng
Anthropic đã ra mắt Claude Fable 5.1 và Claude Mythos 5.1 làm các mô hình chủ lực mới cho lập trình và công việc tri thức.
Anthropic đã thông báo trực tiếp về đợt phát hành này, định vị chúng là “những mô hình tiên tiến nhất thế giới dành cho lập trình và công việc tri thức” thông qua @claudeai
Các nhân sự mảng sản phẩm/kỹ thuật của Anthropic đã định hình Fable 5.1 tập trung cụ thể vào công việc tự hành, đa bước: “công việc phức tạp, đa bước tự vận hành,” với trọng tâm là lập trình, công việc tri thức và giải quyết vấn đề dài hạn thông qua @mikeyk
Anthropic giữ nguyên giá niêm yết cho Fable 5.1 ở mức 10 USD / 50 USD / 12,5 USD trên mỗi triệu token cho đầu vào / đầu ra / ghi bộ nhớ đệm, đồng thời cắt giảm 75% giá đọc bộ nhớ đệm xuống còn 0,25 USD / MTok, một lần nữa được ghi nhận bởi @mikeyk, @Teknium và được định lượng độc lập bởi @ArtificialAnlys
Các ảnh chụp màn hình điểm chuẩn sớm và các đoạn trích từ thẻ hệ thống đã thúc đẩy phần lớn cuộc thảo luận, đặc biệt là xung quanh Terminal-Bench-Science, các đánh giá dòng SWE, HLE, FrontierCode và Artificial Analysis thông qua @StevenDillmann, @scaling01, @ArtificialAnlys
Một tuyên bố diễn giải quan trọng đã xuất hiện từ phân tích của cộng đồng: Fable và Mythos 5.1 có thể có cùng trọng số cơ bản, với hành vi an toàn/định tuyến khác nhau, chứ không phải là các mô hình nền tảng khác nhau, theo @eliebakouch và sau đó là @nrehiew_
Phản ứng của người dùng chia thành nhiều luồng: khen ngợi rất nhiều về khả năng lập trình/lập kế hoạch và giọng điệu, nhưng phàn nàn về giới hạn tốc độ, các cảnh báo giả từ bộ lọc an toàn, trải nghiệm người dùng (UX) khi đăng ký và cách trình bày điểm chuẩn chưa rõ ràng thông qua @danshipper, @theo, @kimmonismus, @GregKamradt, @kylebrussell và @eliebakouch
Thông điệp của chính Anthropic rất thẳng thắn: Fable 5.1 dành cho công việc khó khăn, cần ủy quyền và có tầm nhìn dài hạn, trong khi Mythos 5.1 là bản phát hành đi kèm cho công việc tri thức. Bài đăng ra mắt chính thức nằm tại @claudeai. Các bình luận hỗ trợ từ nhân viên Anthropic nhấn mạnh:
các tác vụ tự hành dài hạn thông qua @mikeyk
cải thiện tính trung thực / báo cáo lỗi tốt hơn (“khi bị kẹt, nó sẽ báo thay vì báo cáo thành công”) thông qua @mikeyk
các kiểm soát mới hướng tới doanh nghiệp, đặc biệt là Enterprise Frontier Safeguards (EFS), được định vị là “ZDR++” để quan sát tác nhân trong môi trường doanh nghiệp thông qua @alexalbert__
hỗ trợ không lưu giữ dữ liệu (zero-data-retention) được người dùng nhấn mạnh là một yếu tố quan trọng để mở khóa việc áp dụng, đặc biệt là @danshipper
Lời chào hàng chính thức không chỉ là “mô hình điểm chuẩn tốt hơn”, mà là “nhân viên tự hành có thể sử dụng được” — đủ nhanh, đủ rẻ trong các thiết lập tác nhân có bộ nhớ đệm và đủ tương thích với doanh nghiệp để triển khai.
Cách định vị đó rất quan trọng vì Fable 5 từng có tiếng — được lặp lại trong các phản ứng — là mạnh mẽ nhưng đôi khi không thực tế. Dan Shipper đã tóm tắt những chỉ trích trước đó rằng Anthropic đã “xây dựng một siêu trí tuệ trong trung tâm dữ liệu mà gần như không thể sử dụng được”, sau đó lập luận rằng bản 5.1 đã giải quyết được sự chậm chạp, tính dài dòng và giọng điệu gượng gạo thông qua @danshipper.
Từ @ArtificialAnlys:
Cửa sổ ngữ cảnh: 1 triệu token
Phương thức: đầu vào văn bản + hình ảnh
Giá cả: không đổi so với Fable 5 cho
đầu vào: 10 USD / 1 triệu token
đầu ra: 50 USD / 1 triệu token
ghi bộ nhớ đệm: 12,5 USD / 1 triệu token
Giá đọc bộ nhớ đệm: giảm từ 1,00 USD xuống 0,25 USD / 1 triệu token (giảm 75%)
Artificial Analysis lưu ý rằng việc cắt giảm bộ nhớ đệm này mang lại lợi ích đáng kể cho các khối lượng công việc tác nhân (agentic workloads), nơi phần lớn lời nhắc (prompt) được đọc lại nhiều lần từ bộ nhớ đệm.
Cũng từ @ArtificialAnlys:
Chỉ số trí tuệ Artificial Analysis: 66 ở mức nỗ lực tối đa
vượt trên:
Claude Opus 5 tối đa: 63
Bài viết được AI dịch và tổng hợp tự động từ Latent Space. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.