IT Home ITHome
92

Mô hình

Anthropic ra mắt Claude Opus 5.5: Hiệu năng vượt trội, chi phí vận hành giảm 40%

(giờ Việt Nam)

Tóm tắt AI

Anthropic vừa trình làng Claude Opus 5.5, mẫu AI mạnh mẽ nhất trong dòng 5.5 với khả năng xử lý tác vụ phức tạp vượt trội, độ bảo mật cao nhất từ trước đến nay và chi phí vận hành tiết kiệm hơn 40% so với thế hệ tiền nhiệm.

Bản dịch AI

Theo tin từ IT ngày 23 tháng 9, Anthropic hôm nay đã chính thức ra mắt mô hình Claude Opus 5.5, thành viên đầu tiên trong dòng Claude 5.5 hoàn toàn mới. Hãng tuyên bố mô hình này có hiệu suất trong hầu hết các tác vụ ngang ngửa với Claude Fable 5.1, trong khi chi phí vận hành thấp hơn 40% so với Opus 5.

Theo thông tin từ thông báo của Anthropic mà IT ghi nhận được, cụ thể, mô hình Claude Opus 5.5 có những cải tiến sau:

Về hiệu năng, Opus 5.5 đã có bước tiến lớn so với Opus 5. Anthropic cho biết những người thử nghiệm sớm đã ghi nhận hiệu suất tăng vọt trong các tác vụ phức tạp nhất. Một người thử nghiệm đã hoàn thành việc chuyển đổi 680.000 dòng mã trong chưa đầy một ngày — một nhiệm vụ vốn dĩ phải mất hàng tuần. Opus 5.5 rất giỏi trong việc phát hiện và sửa lỗi các chương trình kém hiệu quả; khi được yêu cầu rút ngắn thời gian tải cho từng trang của một ứng dụng web, Opus 5.5 đã thành công 39 trên 40 lần thử nghiệm, trong khi Opus 5 chỉ thực hiện được một vài cải tiến nhỏ và còn làm thay đổi hành vi của ứng dụng. Một người thử nghiệm khác đã yêu cầu nhiều mô hình Claude cùng xây dựng một trò chơi dựa trên một câu lệnh duy nhất, và Opus 5.5 đã đạt điểm số cao hơn bất kỳ mô hình nào khác nhờ vào hình ảnh và độ tinh xảo.

Về bảo mật, Opus 5.5 đã đạt điểm số cao nhất từ trước đến nay trong các bài kiểm tra đánh giá hành vi tự động của Anthropic, bộ công cụ này kiểm tra Claude thông qua hàng ngàn kịch bản mô phỏng. Mô hình này có xác suất thực hiện các hành động khó đảo ngược hoặc vượt quá giới hạn thiết lập thấp hơn so với các mô hình mới ra mắt gần đây, đồng thời có khả năng chống lại các cuộc tấn công tiêm nhiễm câu lệnh (prompt injection) tốt hơn Opus 5. Hãng cũng đã mở rộng phạm vi kiểm tra căn chỉnh (alignment testing), bao gồm các tác vụ dài hơn, các nhiệm vụ bất khả thi và các kịch bản dựa trên sự kiện thực tế.

Do Opus 5.5 có năng lực tương đương với Claude Mythos 5.1 trong lĩnh vực sinh học và an ninh mạng, Anthropic đã áp dụng các biện pháp bảo vệ tương tự như Claude Fable 5.1 khi triển khai. Các tổ chức đã qua kiểm duyệt có thể đăng ký chương trình xác thực khoa học sự sống ngay từ hôm nay để sử dụng Opus 5.5 cho nghiên cứu sinh học. Trong vài tuần tới, Anthropic cũng sẽ mở rộng quyền truy cập vào các chương trình xác thực mạng, cho phép các chuyên gia an ninh mạng được chứng nhận sử dụng Opus 5.5 cho công việc của họ.

Về chi phí và tốc độ, Opus 5.5 yêu cầu ít tài nguyên tính toán hơn Opus 5 và mức giá cũng phản ánh điều này. Các thử nghiệm chính thức cho thấy, ở cài đặt mặc định, chi phí của Opus 5.5 cho các khối lượng công việc điển hình thấp hơn 40% so với Opus 5. Tốc độ xuất dữ liệu của Opus 5.5 cũng nhanh hơn Opus 5 hơn 30%.

Giá cho mỗi triệu Token đầu vào và đầu ra lần lượt là 4 USD và 20 USD, thấp hơn 20% so với Opus 5.

Giá cho cache hit là 0,20 USD/triệu Token, thấp hơn 60% so với Opus 5.

Ngoài việc giảm giá, Anthropic cũng nới lỏng giới hạn thời gian sử dụng cho các gói doanh nghiệp như Pro, Max, Team, đồng thời cung cấp tính năng đặt lại giới hạn tốc độ (rate limit) cho người dùng đăng ký, cho phép khách hàng lưu trữ và sử dụng bất cứ lúc nào.

Về khả năng giao tiếp, Opus 5.5 trò chuyện tự nhiên hơn các mô hình trước đó. Những người thử nghiệm sớm nhận thấy văn bản của nó rõ ràng và dễ hiểu hơn, nó ưu tiên đưa thông tin quan trọng nhất lên đầu và trở thành một cộng sự làm việc tốt hơn trong quá trình huấn luyện lâu dài. Như một người thử nghiệm sớm đã nói: "Cách nó viết giống hệt tôi."

Claude Sonnet 5.5 và Claude Haiku 5.5 sẽ được ra mắt trong vài tuần tới, với nhiều cải tiến tương tự về hiệu suất, hiệu quả và bảo mật.

Trong các bài kiểm tra chuẩn (benchmark) chính thức của Anthropic, Claude Opus 5.5 tiếp tục dẫn đầu về khả năng lập trình thông minh, sử dụng máy tính và các công việc tri thức.

AnthropicClaudeAIOpus 5.5Công nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.