Tin ngành
OpenAI tối ưu hóa GPT-5.6: Giảm 20% chi phí vận hành nhờ mô hình tự cải tiến
(giờ Việt Nam)
Tóm tắt AI
OpenAI vừa triển khai mô hình GPT-5.6 Sol để tự động tối ưu hóa quy trình suy luận và mã nguồn GPU, giúp giảm tới 20% chi phí dịch vụ và tăng 15% tốc độ tạo token.
Bản dịch AI
Theo tin từ IT ngày 30 tháng 7, OpenAI đã đăng tải một bài viết trên blog vào ngày hôm qua (29 tháng 7), thông báo về việc sử dụng mô hình GPT-5.6 Sol để tối ưu hóa chuỗi suy luận AI của chính dòng mô hình GPT-5.6, giúp giảm chi phí dịch vụ đầu cuối lên đến 20%.
OpenAI đã ra mắt dòng mô hình AI mạnh mẽ nhất của mình là GPT-5.6 vào ngày 9 tháng 7. Trong quá trình tối ưu hóa kiến trúc sau đó, đội ngũ chính thức đã tận dụng mô hình GPT-5.6 Sol để cải thiện hiệu suất vận hành, giảm chi phí tính toán và nâng cao hiệu suất sử dụng GPU.
OpenAI cho biết hệ thống sẽ phân bổ các yêu cầu dựa trên khu vực địa lý, dung lượng khả dụng và loại bộ tăng tốc; bên trong cụm máy chủ, các tác vụ cũng sẽ được phân phối dựa trên các yếu tố như tải trọng, độ dài ngữ cảnh và khả năng lưu trữ cache. GPT-5.6 Sol phân tích lưu lượng sản xuất thông qua Codex, xác định nguồn gốc gây mất cân bằng tải, kiểm tra các chiến lược định tuyến và điều chỉnh các quy tắc heuristic.
Trong giai đoạn truyền tiến (forward propagation) của mô hình, GPT-5.6 Sol xác định các công việc có thể tính toán trước, có thể tránh hoặc có thể thực hiện song song, đồng thời tự động viết lại và tối ưu hóa các nhân (kernel) GPU trong môi trường sản xuất thông qua Codex. IT đính kèm ảnh chụp màn hình liên quan như sau:

Đội ngũ đã cho mô hình GPT-5.6 Sol học hai ngôn ngữ lập trình là Triton và Gluon, cho phép mô hình tối ưu hóa các nhân của công cụ suy luận dựa trên đó, giúp giảm chi phí dịch vụ đầu cuối từ các nhân GPU trong môi trường sản xuất lên đến 20%.

OpenAI cũng sử dụng công cụ mã nguồn mở FpSan (trình làm sạch số dấu phẩy động) để xác minh tính chính xác của các nhân do GPT-5.6 Sol viết.
OpenAI còn để GPT-5.6 Sol tối ưu hóa giải mã suy đoán (speculative decoding). Công nghệ tăng tốc suy luận này sử dụng một mô hình dự thảo nhỏ hơn để dự đoán token tiếp theo, sau đó mô hình chính sẽ xác minh hoặc sửa chữa các kết quả dự đoán. Trong bài đăng công khai ngày 29 tháng 7 năm 2026, OpenAI cho biết hiệu suất tạo token sau khi cải tiến đã tăng hơn 15%.
Thông báo quảng cáo: Các liên kết chuyển hướng bên ngoài trong bài viết (bao gồm nhưng không giới hạn ở siêu liên kết, mã QR, mật khẩu, v.v.) được sử dụng để truyền tải thêm thông tin và tiết kiệm thời gian sàng lọc, kết quả chỉ mang tính chất tham khảo. Tất cả các bài viết trên IT đều bao gồm thông báo này.
Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.