IT Home
Điểm AI 59/100

Mô hình

Lộ diện Claude Sonnet 5.5: Hiệu năng vượt mặt GPT-6 Sol, thách thức Astra

(giờ Việt Nam)

Tóm tắt AI

Nhiều nhà phát triển trên X xác nhận Claude Sonnet 5.5 đã xuất hiện trong cấu hình chính thức của Anthropic với định danh 'claude-sonnet-5-5' và đang được thử nghiệm giới hạn trên Claude Code.

Chính văn · Bản dịch AI

Ai mà ngờ được, Opus 5.5 vừa ra mắt chưa được mấy ngày, Sonnet 5.5 cũng sắp sửa trình làng?

Từ tối qua, cả X (Twitter) đã lan truyền thông tin này: Sonnet 5.5 sắp sửa được phát hành, có lẽ là vào chiều thứ Ba theo giờ Mỹ.

Về hiệu năng, Sonnet 5.5 tiệm cận với Opus 5.5 nhưng lại có mức giá rẻ hơn rất nhiều.

Hiện tại, Sonnet 5.5 đã bước vào giai đoạn cuối trước khi ra mắt và đang được thử nghiệm giới hạn (gray-box testing) trong Claude Code.

Các bản demo được nhiều chuyên gia thử nghiệm nội bộ tiết lộ cho thấy, Sonnet 5.5 đã nghiền nát GPT-6 Sol vừa mới ra mắt, thậm chí trong khả năng lập trình và tác vụ Agent, nó còn bám đuổi sát nút "siêu phẩm" hàng đầu của OpenAI là GPT-6 Astra!

Đáng kinh ngạc hơn, mức giá của nó rẻ đến mức khó tin, chỉ 2 USD cho mỗi triệu token đầu vào (IT lưu ý: tỷ giá hiện tại tương đương khoảng 13,4 nhân dân tệ).

Nếu thời điểm ra mắt bị rò rỉ là chính xác, có vẻ như Anthropic đã quyết tâm "ngáng đường" sự kiện Dev Day của OpenAI.

Sonnet 5.5 bị rò rỉ, định danh mô hình độc quyền đã xuất hiện

Còn nhớ ngày 22 tháng 9, khi Anthropic bất ngờ phát hành Opus 5.5, họ đã tiện tay viết một dòng trong tài liệu chính thức: "Sonnet 5.5 và Haiku 5.5 sẽ được ra mắt trong vài tuần tới".

Không ai ngờ rằng, Sonnet 5.5 lại đến nhanh như vậy!

Ngay ngày hôm qua, nhà phát triển nổi tiếng @Mr_Salio đã tiết lộ trên X: Claude Sonnet 5.5 đã bị "bắt bài"! Tin tức ngay lập tức lan truyền khắp mạng xã hội.

Trong artifact, định danh cấu hình mô hình độc quyền của Sonnet 5.5 đã xuất hiện rõ ràng: "claude-sonnet-5-5".

Không chỉ vậy, trong cùng tệp cấu hình đó còn liệt kê song song các tên "claude-opus-5-5", "claude-sonnet-5" và một cái tên bí ẩn "claude-fable-5.1".

Việc ghi mã nguồn vào frontend đồng nghĩa với việc mô hình đã được cài đặt trên máy chủ, chỉ chờ một nút kích hoạt.

Sau đó, tài khoản nổi tiếng @notjazii cũng tiết lộ rằng, thực tế Sonnet 5 đã được âm thầm định tuyến sang phiên bản 5.5 để "thử nghiệm ngầm" từ khoảng một tuần trước.

Bạn đã được chọn để thử nghiệm chưa? Lần này vẫn dùng cách cũ.

Mở Claude Code của bạn lên, tắt tính năng kết nối mạng và bộ nhớ, rồi hỏi trực tiếp nó: Bạn có biết "tibo" (người reset) không? Nhớ đừng dùng mạng và bộ nhớ.

Nếu bạn đang dùng phiên bản mô hình cũ, nó có thể sẽ trả lời lung tung; nhưng nếu bạn đã được định tuyến sang phiên bản 5.5, nó sẽ kể lại chính xác ngọn ngành về Tibo và meme reset Codex.

Nhiều cư dân mạng xác nhận, một số tài khoản thực sự đã được chuyển đổi âm thầm, họ đang được trải nghiệm trước Opus 5.5.

记住要用 Claude Code

Hãy nhớ sử dụng Claude Code.

Kết quả thử nghiệm toàn mạng: Đánh bại cả GPT-6

Tổng kết các thử nghiệm được chia sẻ hiện nay, Sonnet 5.5 thực sự đã nghiền nát GPT-6 Sol?

Đầu tiên là màn đối đầu cực hạn về UI/Animation frontend bằng JS, với sự tham gia của bốn mô hình ngôn ngữ lớn phổ biến.

Nhà phát triển @notjazii đã tung ra một loạt thử nghiệm có tính trực quan cao: "So sánh tạo hiệu ứng động với cùng một câu lệnh trên bốn mô hình phổ biến".

Anh ấy yêu cầu các mô hình tạo ra hiệu ứng hoạt họa UI phức tạp. Sau khi tung ra ảnh động so sánh, @notjazii nhận xét: "Sonnet 5.5 thực sự đã chà đạp cả hai mô hình của OpenAI (Sol và Astra)!"

Quả thực, từ hình ảnh dưới đây có thể thấy, Sonnet 5.5 thể hiện trực giác lập trình và gu thẩm mỹ cực kỳ vượt trội.

GPT-6 Astra

▲ GPT-6 Astra

▲ GPT-6 Sol

▲ Claude Opus 5.5

▲ Claude Sonnet 5.5

Một cư dân mạng sau khi thấy kết quả đã không thể tin nổi: "Claude luôn mạnh hơn về UI và hoạt họa, nhưng nếu đây là kết quả tạo ra hoàn toàn bằng code thì thật khó tin!"

Tài khoản nổi tiếng @chetaslua đã tập trung thử nghiệm khả năng lập trình hàng ngày và "cảm giác code" của Sonnet 5.5.

Anh ấy sử dụng cùng 3 câu lệnh, thực hiện 6 lần chạy song song, mỗi mô hình tạo ra một lần, kết quả đầu ra không qua chỉnh sửa.

Sonnet 5.5 cuối cùng tạo ra 3 tệp có dung lượng 90–131 KB, tất cả các lần chạy đều chạm ngưỡng giới hạn 90 phút; GPT-6 Sol tạo ra tệp có dung lượng từ 20–29 KB, mất khoảng 9-12 phút.

Bài gốc còn tiếp — xem tiếp tại bài gốc ↗

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Xem toàn bộ
Ra mắt Opus 5.5: Khả năng giao tiếp tốt hơn, giá mỗi token thấp hơn Opus 5.0, sở hữu trí tuệ ngang tầm Fable 5.1, hiện đã có mặt trên Claude Code
Lộ diện Claude Sonnet 5.5: Hiệu năng vượt mặt GPT-6 Sol, thách thức Astra | AIHOT.vn