QbitAI
92

Mô hình

GLM-5.3 chính thức ra mắt: Khả năng lập trình vượt trội, tìm ra cả lỗi bảo mật 40 năm tuổi

(giờ Việt Nam)

Tóm tắt AI

GLM-5.3 vừa trình làng với hiệu suất lập trình tiệm cận Fable 5, đồng thời xác lập vị thế là mô hình mã nguồn mở mạnh mẽ nhất trong lĩnh vực bảo mật.

Bản dịch AI

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

14-08-2026 16:47:51 Nguồn: QbitAI

Dễ dàng giành lấy danh hiệu mô hình mã nguồn mở an toàn nhất

Kim Lỗi đưa tin từ Aofei Temple

QbitAI | Kênh chính thức QbitAI

Thật là náo nhiệt.

Hôm qua là màn "so kè" giữa DeepSeek V4 Pro bản chính thức + Harness và Grok 4.6, thì hôm nay GLM-5.3 lại tỏa sáng với màn "xuất trận" đầy ấn tượng—

Ngay khi vừa ra mắt đã giành lại vị thế dẫn đầu trong các mô hình mã nguồn mở, dẫn đầu các mô hình nội địa, thậm chí về khả năng lập trình (Coding) còn tiệm cận với Claude Fable 5!

Nói cách khác, "lời hứa" mà Đường Kiệt từng vẽ ra cho Musk (rằng mô hình nội địa sẽ sớm vượt qua Fable 5) đã tiến một bước dài, và tất cả chỉ mất đúng 2 tháng.

Trong nhiều bài kiểm tra tiêu chuẩn phổ biến, GLM-5.3 hiện là mô hình mã nguồn mở có thứ hạng cao nhất, với khả năng lập trình và tác nhân (agent) tiệm cận Claude Fable 5, đồng thời trải nghiệm lập trình vượt trội hơn các mô hình nội địa khác.

Đáng chú ý hơn cả là hiệu suất ở các mức độ suy luận khác nhau. Khi ngân sách Token tăng lên, độ chính xác trong lập trình của GLM-5.3 tiếp tục cải thiện; ở mức High, mô hình này đã có thể đạt được độ chính xác vượt qua mức cao nhất của Claude Opus 4.8 với mức tiêu thụ Token thấp hơn đáng kể.

Nhưng đừng vội trầm trồ hay kinh ngạc, vì màn kịch hay vẫn còn ở phía sau.

Lần này, ngoài Coding, một từ khóa quan trọng khác của GLM-5.3 chính là bảo mật.

Trong bài kiểm tra đánh giá mã nguồn hộp trắng (white-box) CyberGym, GLM-5.3 đạt 84,5%, tiếp tục cải thiện so với mức 77,2% của bản 5.2, đồng thời nhỉnh hơn một chút so với Mythos 5 và GPT-5.6 Sol, chính thức trở thành mô hình mã nguồn mở an toàn nhất.

Hơn nữa, hai tuần trước khi GLM-5.3 ra mắt, Zhipu đã phối hợp cùng Đại học Thanh Hoa, Đại học Nam Khai, cùng nhiều doanh nghiệp và phòng thí nghiệm trong nước để tiến hành các đợt kiểm thử đỏ (red teaming) và đánh giá bảo mật chuyên sâu.

Được biết, tổng cộng đã có 2404 lỗ hổng được phát hiện (sau khi sàng lọc sơ bộ và loại bỏ trùng lặp), trong đó có 1088 lỗ hổng ở mức độ trung bình đến cao, bao phủ 220 dự án bao gồm nhân hệ thống, hệ điều hành, công cụ trình duyệt, các thành phần cơ sở mã nguồn mở, ứng dụng internet và các giao thức internet.

Thậm chí, lỗi lâu đời nhất được tìm thấy có thể truy xuất ngược lại tận 40 năm trước!

Vì vậy, với lần ra mắt GLM-5.3 này, hai từ khóa của Zhipu đã trở nên rõ ràng: một là Coding, hai là bảo mật.

Không có gì ngạc nhiên khi GLM-5.3 vừa ra mắt đã ngay lập tức thu hút sự chú ý và thảo luận sôi nổi trên X, cư dân mạng đã gọi nó là mô hình "cấp độ Fable 5":

Phải nói rằng, lần này GLM-5.3 lại một lần nữa nâng tầm AI nội địa trên trường quốc tế, khung cảnh hoành tráng này thực sự ứng với "danh ngôn" của Lãm lão:

Người Trung Quốc có thể bay~ Người Trung Quốc có thể bay~

Điểm quan trọng nhất là, trong quá trình trải nghiệm thực tế GLM-5.3, cảm nhận của chúng tôi thực sự có thể tóm gọn trong một câu:

Mượt mà, cực kỳ mượt mà! Có chút vượt ngoài mong đợi.

Tiếp theo, theo thông lệ cũ, chúng ta sẽ đi vào một loạt các bài kiểm tra chuyên sâu~

Đã tạo ra một trò chơi mô phỏng có thể bàn giao

Tất cả các bài kiểm tra của chúng tôi lần này đều được thực hiện trên Harness của chính Zhipu, tức là ZCode.

Nhiệm vụ đầu tiên, hãy thử sức với tiêu chuẩn "Chúa tể những chiếc nhẫn" (Lord of the Rings) mà Karpathy vừa tung ra.

Sau khi nhập văn bản mở đầu chương 1 của "Chúa tể những chiếc nhẫn" và Prompt tương ứng, chúng tôi chọn mô hình GLM-5.3 bản thử nghiệm nội bộ đã nhận được trước đó và chuyển sang chế độ "truy cập toàn quyền", đảm bảo không có sự can thiệp của con người trong suốt quá trình:

Sau đó, GLM-5.3 bắt đầu tự động làm việc một cách nhanh chóng, việc duy nhất bạn cần làm là chờ đợi:

Sau 28 phút, một tiêu chuẩn "Chúa tể những chiếc nhẫn" phiên bản tiếng Trung đã được hoàn thành một cách xuất sắc:

Địa chỉ video: https://mp.weixin.qq.com/s/LXLsciw8OqStAyxWnktbzg

Nhiệm vụ do Karpathy thiết kế này kiểm tra khả năng của mô hình trong việc tự lập kế hoạch dài hạn, viết mã, sắp xếp tài sản 3D, biên tập hoạt ảnh và tạo ra một tác phẩm hoàn chỉnh có thể chạy được.

Hơn nữa, chúng tôi còn cố tình tăng độ khó trong Prompt, yêu cầu AI tự chuyển thể văn bản gốc thành lời dẫn tiếng Trung dài khoảng 90 giây mà không được thay đổi cốt truyện chính.

Nhìn vào kết quả của GLM-5.3, nó không chỉ đáp ứng được các yêu cầu cơ bản của bài kiểm tra mà còn biết nắm bắt trọng tâm từ văn bản văn học và tái tổ chức chúng thành ngôn ngữ nghe nhìn.

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.