Mô hình
Đánh giá năng lực Claude Mythos 5.1 và Fable 5.1: Một trải nghiệm kỳ lạ
(giờ Việt Nam)
Tóm tắt AI
Bài viết phân tích sâu về khả năng thực tế của hai mô hình mới nhất từ Anthropic trong bối cảnh ra mắt đầy bất ngờ và khó hiểu.
Bản dịch AI

Đây là tình huống kỳ lạ nhất để viết một bài đánh giá năng lực mô hình.
Xin giới thiệu mô hình mạnh mẽ nhất thế giới, với khoảng cách vượt trội. Khoan đã, tin mới nhận, chúng ta lại có thêm một bên khác cũng vừa giới thiệu mô hình mạnh mẽ nhất thế giới.
Claude Fable 5.1 và GPT-6 Astra đều là những mô hình xuất sắc. Điều này thì chúng ta đã rõ.
Fable 5.1 đi kèm với mức giá bộ nhớ đệm (cache) giảm, tùy chọn không lưu giữ dữ liệu và các bộ phân loại (classifiers) nới lỏng hơn đáng kể so với Fable 5.
Những dấu hiệu ban đầu, dù biên độ sai số còn lớn, cho thấy bước nhảy vọt từ Sol sang Astra lớn và thú vị hơn so với bước nhảy từ Fable 5 lên Fable 5.1. Điều này có thể tương tự như cách bước tiến về quy mô từ Opus sang Fable từng là một sự kiện lớn.
Ngoại trừ việc sử dụng token, Fable 5.1 nhận được phản hồi tích cực gần như tuyệt đối xét trên các tiêu chí khách quan. Các báo cáo cho thấy Fable 5.1 rất toàn diện. Khả năng viết lách được cải thiện đáng kể. Các "Claudisms" (phong cách đặc trưng của Claude) dường như đã được cải thiện, mặc dù một số vẫn còn đó. Nó biết thừa nhận sai sót. Mọi người thích trò chuyện với nó. Nhiều người lưu ý rằng nó giúp đơn giản hóa mã nguồn. Các bộ phân loại an toàn cũng bớt gây khó chịu hơn.
Fable 5.1 rất thích chủ động và làm mọi thứ. Nếu bạn cung cấp cho nó mức độ nỗ lực cao, nó sẽ tìm ra những việc để làm với số token đó. Thường thì đó sẽ là những việc hữu ích.
Trải nghiệm của riêng tôi là cả Fable 5.1 và Astra đều xuất sắc. Trong trường hợp tôi có cơ hội so sánh các phản hồi cho một câu hỏi khó, cả hai câu trả lời đều khác biệt và rất tốt, bổ sung cho nhau. Kế hoạch của tôi là "song kiếm hợp bích", hỏi cả hai cho tất cả các truy vấn không tầm thường, ít nhất là trong một thời gian.
Hầu hết bài đánh giá này bắt buộc phải xem xét Fable 5.1 một cách độc lập, thay vì có thể so sánh nó với Astra, và hầu hết những người phản hồi cũng đang làm như vậy. Sẽ có bài đánh giá đầy đủ về Astra sau đó, điều này sẽ mang lại nhiều cơ hội so sánh hơn.

Lời giới thiệu chính thức.
Giá của chúng tôi rất rẻ.
Không lưu giữ dữ liệu và giảm bớt các biện pháp bảo vệ.
Các điểm chuẩn (benchmarks) chính thức.
Các điểm chuẩn từ bên thứ ba.
System Prompt (Lời nhắc hệ thống).
Các đoạn giới thiệu quảng bá.
Mọi bài đánh giá đều đã có và kết quả là rất tốt.
Các phản ứng tích cực.
Giá của chúng tôi rất rẻ nhưng chỉ tính theo token.
Các phản ứng tiêu cực.
Những lời đồn đoán ban đầu.
Vũ khí lựa chọn.
Như thường lệ, Anthropic về cơ bản đã nói "đây là mô hình mới với con số cao hơn."
Bộ phận lập trình cho rằng nó rất giỏi trong việc viết code, và giá của chúng tôi cũng rất rẻ.
Boris Cherny (Người tạo ra Claude Code, Anthropic): Fable 5.1 là mô hình tốt nhất của chúng tôi từ trước đến nay cho việc lập trình, phân tích dữ liệu, sử dụng máy tính, thiết kế, thuyết trình, Tag và các công việc đại lý (agentic) dài hạn khó nhất.
Mô hình này rất tuyệt vời để làm việc cùng, và tôi đã sử dụng nó cho mọi thứ.
Chúng tôi cũng đã giảm giá cho khách hàng doanh nghiệp, API và SDK. Giá đọc bộ nhớ đệm trên Fable 5.1 hiện là 0,25 USD trên mỗi triệu token (trước đây là 1 USD). Rẻ hơn tới 38% cho một phiên Claude Code điển hình.
Chúng tôi đã nghiên cứu về tần suất can thiệp của các biện pháp bảo vệ. Các biện pháp bảo vệ sinh học mới nhất của chúng tôi can thiệp vào các yêu cầu lành tính ít hơn 85% so với những gì chúng tôi đã phát hành cùng Fable 5, và người dùng Claude Code sẽ thấy ít hơn khoảng 60% sự can thiệp về an ninh mạng mỗi phiên. Hãy chờ đợi thêm nhiều cải tiến sớm ra mắt.
Cuối cùng nhưng không kém phần quan trọng, Fable 5.1 viết tốt hơn và có tông giọng tốt hơn. Chúng tôi đã lắng nghe phản hồi của các bạn và đang tích cực làm việc để giảm bớt "Claude-speak". Đã có những tiến bộ vững chắc với bản 5.1, và sẽ còn nhiều điều nữa sắp tới.
Alex Albert nhấn mạnh khả năng tạo video thông qua mã nguồn của nó. Ví dụ của anh ấy là anh ấy đã chụp ảnh một lô đất, và yêu cầu Fable thiết kế một ngôi nhà, kết xuất (render) nó và tạo ra một đoạn video đi dạo điện ảnh, video ngắn tại liên kết.
Họ dành một phần cho nghiên cứu khoa học. Đó cũng là một điểm nhấn của OpenAI.
Anthropic đang làm một điều kỳ lạ với giá của Fable 5.1. Giá niêm yết không thay đổi so với Fable 5, nhưng giá thực tế lại thấp hơn vì họ đang giảm giá đọc bộ nhớ đệm từ 1 USD xuống 0,25 USD trên mỗi triệu token.
Điều này sẽ làm giảm chi phí trung bình trên mỗi token xuống 25% và chi phí cho các công việc mang tính đại lý cao xuống "lên tới khoảng 45%", phù hợp với con số 38% rẻ hơn cho việc sử dụng Claude Code điển hình của Boris:

Tôi cho rằng điều này giúp căn chỉnh các ưu đãi bằng cách khớp với chi phí thực tế, nhưng tôi đã có xu hướng đưa một phần chiết khấu vào giá niêm yết hơn. Con người là những sinh vật đơn giản, đôi khi bạn phải nói chuyện với họ ở mức độ của họ.
Chỉ số LLM: 🆕 Claude Fable 5.1 đã có mặt trên OpenRouter.
Mô hình mới của Anthropic có giá 10,00 USD/triệu token đầu vào, 50,00 USD/triệu token đầu ra.
Không có giá tiền nhiệm hay lịch sử đi kèm. Thông tin rõ ràng chính là danh sách này: một mục sản phẩm Claude cao cấp, hiện đã được định giá trên OpenRouter.
Bài viết được AI dịch và tổng hợp tự động từ Don't Worry About the Vase (Zvi). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.