TechCrunch: AI
92

Mô hình

Anthropic ra mắt Opus 5.5: Hiệu năng vượt trội, giá thành tối ưu hơn

(giờ Việt Nam)

Tóm tắt AI

Anthropic vừa trình làng Opus 5.5 với khả năng lập trình và xử lý tri thức vượt xa Fable, đồng thời giảm giá token xuống còn 20 USD/triệu đơn vị cùng tốc độ phản hồi nhanh hơn.

Bản dịch AI

Anthropic releases Opus 5.5 with lower prices and Fable-level performance

Anthropic vừa ra mắt Opus 5.5 vào thứ Ba, thiết lập một tiêu chuẩn hiện đại mới về hiệu suất trong lĩnh vực lập trình và xử lý tri thức. Đáng chú ý, phiên bản này vượt trội hơn cả mô hình Fable lớn hơn trong nhiều bài kiểm tra đánh giá (benchmark), đồng thời hoàn thành thành công một số tác vụ không chính thức mà Fable trước đó đã thất bại.

Trong thông báo của mình, Anthropic gọi Opus 5.5 là “mô hình có hiệu suất mạnh mẽ nhất mà chúng tôi từng thử nghiệm cho đến nay.”

Mô hình mới này cũng có chi phí rẻ hơn đáng kể so với phiên bản tiền nhiệm. Token đầu ra sẽ có giá 20 USD trên mỗi mTok đối với Opus 5.5, so với mức 25 USD của mô hình trước đó. Các chỉ số khác cũng có mức giảm giá tương tự. Mô hình này cũng vận hành nhanh hơn, phản ánh sự sụt giảm tổng thể về yêu cầu tính toán.

Phiên bản mới cũng mang đến những thay đổi đáng kể trong cách Opus giao tiếp, với việc Opus 5.5 ít sử dụng thuật ngữ chuyên môn hơn và ưu tiên đưa thông tin quan trọng lên đầu các tin nhắn của mình.

Sự kiện ra mắt này diễn ra chỉ hai tháng sau khi Opus 5 được phát hành vào ngày 24 tháng 7. Theo thông báo, Sonnet 5.5 và Haiku 5.5 sẽ được ra mắt “trong những tuần tới” với những cải tiến về hiệu suất tương tự.

Anthropic cho biết Opus 5.5 có khả năng tương đương với Mythos trong các lĩnh vực sinh học và an ninh mạng, vì vậy việc phát hành mô hình này phải tuân thủ các biện pháp bảo vệ tương tự như mô hình Fable của công ty. Các biện pháp bảo vệ này hạn chế mức độ sử dụng mô hình để tìm kiếm lỗ hổng trong các chương trình đã biên dịch hoặc phát triển các loại vũ khí sinh học có thể nhận diện, cùng nhiều tác vụ khác.

Opus 5.5 là mô hình đầu tiên được Anthropic phát hành kể từ khi CEO Dario Amodei ủng hộ lời kêu gọi kiểm soát tốc độ phát triển công nghệ tiên phong, chủ động làm chậm tiến độ các khả năng của AI để bắt kịp tốc độ phát triển của các biện pháp căn chỉnh (alignment).

“Tôi tin rằng việc giải quyết triệt để các rủi ro đòi hỏi sự thận trọng hơn nữa,” Amodei đã viết trong một bài đăng đầu tháng này, “không chỉ là đầu tư vào việc phòng ngừa rủi ro, mà còn là điều tiết tốc độ nâng cao năng lực để các biện pháp phòng ngừa có thời gian bắt kịp.”

Quy trình đào tạo an toàn của Opus 5.5 nhìn chung tương tự như các phiên bản tiền nhiệm, bao gồm kiểm tra căn chỉnh và đánh giá trước khi phát hành bởi các tổ chức bên ngoài như METR và Frontier Design. Tuy nhiên, Anthropic nhấn mạnh rằng các hệ thống đào tạo và đánh giá tiên tiến hơn đã được chuẩn bị cho các mô hình tương lai, bao gồm cả các hệ thống bảo mật và giám sát được cải thiện.

“Khi AI ngày càng trở nên mạnh mẽ hơn, chính sách công cần đóng vai trò lớn hơn trong việc đảm bảo các hệ thống mà mọi người dựa vào đều an toàn. Năng lực đó cần thời gian để xây dựng, và chúng tôi đã bắt đầu thiết lập cơ sở hạ tầng để hỗ trợ điều này,” bài đăng trên blog cho biết. “Chúng tôi hy vọng sẽ sớm chia sẻ thêm chi tiết về những nỗ lực này.”

Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể nhận được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập trong công tác biên tập của chúng tôi.

Russell Brandom đã theo dõi ngành công nghệ từ năm 2012, tập trung vào chính sách nền tảng và các công nghệ mới nổi. Trước đây, anh từng làm việc tại The Verge và Rest of World, đồng thời viết bài cho Wired, The Awl và MIT’s Technology Review. Bạn có thể liên hệ với anh ấy qua email [email protected] hoặc qua Signal theo số 412-401-5489.

Xem tiểu sử

Event Logo
AnthropicOpus 5.5LLMTrí tuệ nhân tạoCông nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ TechCrunch: AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.