Mô hình
Zhipu AI công bố bước tiến về tự cải tiến đệ quy và ra mắt mô hình GLM-5.3-Flash
(giờ Việt Nam)
Tóm tắt AI
Đội ngũ Zhipu AI lần đầu ứng dụng thành công kỹ thuật tự cải tiến đệ quy, trong đó mô hình GLM-5.3 đã tự thiết kế và tối ưu hóa hạ tầng suy luận cho phiên bản GLM-5.3-Flash.
Bản dịch AI
Theo tin từ IT ngày 17 tháng 9, hôm nay, đội ngũ Zhipu GLM đã công bố bước tiến thực nghiệm kỹ thuật đầu tiên trong lĩnh vực Tự cải tiến đệ quy (Recursive Self-Improvement - RSI), cụ thể là cho phép AI tự tay cải tiến hệ thống vận hành của chính mình.

Cụ thể, Infra Agent được vận hành bởi GLM-5.3 đã hoàn thành việc thiết kế, gỡ lỗi và tối ưu hóa cơ sở hạ tầng suy luận cho GLM-5.3-Flash, qua đó hiện thực hóa khả năng mô hình tự cải tiến ngược lại hệ thống vận hành của bản thân.

Theo blog chính thức, Infra Agent đã hoàn thành việc xây dựng dịch vụ suy luận cấp sản xuất từ con số không trên một cụm gồm hơn 100.000 chip nội địa. Trong chưa đầy hai tuần, hệ thống này đã nâng lưu lượng truy cập đầu cuối (end-to-end throughput) lên gấp 3 lần so với mức cơ sở ban đầu, đồng thời đưa hiệu suất sử dụng phần cứng và chi phí trên mỗi Token đạt mức tương đương với các GPU NVIDIA phổ biến. Hệ thống này đã được đưa vào sử dụng thực tế; GLM-5.3-Flash đã ra mắt trên OpenCode và OpenRouter dưới tên mô hình ẩn danh Ox-Alpha, với lưu lượng gọi Token vượt quá 62 nghìn tỷ trong vòng 6 ngày.
IT lưu ý rằng, đây là lần đầu tiên một nhà sản xuất mô hình ngôn ngữ lớn trong nước công khai áp dụng "AI tự cải tiến" vào môi trường sản xuất, đồng nghĩa với việc AI không chỉ dừng lại ở việc viết mã mà còn có thể tham gia vào toàn bộ vòng lặp kỹ thuật của hệ thống suy luận.
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.