Sản phẩm
GPT-5.6 Sol ra mắt chế độ Ultrafast: Tốc độ suy luận tăng gấp 14 lần nhờ sức mạnh từ Cerebras
(giờ Việt Nam)
Tóm tắt AI
OpenAI giới thiệu chế độ Ultrafast cho GPT-5.6 Sol với tốc độ đạt 750 token/giây, gấp 14 lần nhờ hạ tầng từ Cerebras. Dịch vụ hiện đang thử nghiệm cho khách hàng API chọn lọc trước khi mở rộng quy mô.
Bản dịch AI

OpenAI đang ra mắt bản xem trước cho chế độ "Ultrafast" mới, cho phép đạt tốc độ lên tới 750 token đầu ra mỗi giây từ mô hình chủ lực GPT-5.6 Sol.
Khả năng tăng tốc suy luận này đến từ Cerebras, đơn vị đã ký kết quan hệ đối tác trị giá mười tỷ đô la với OpenAI vào đầu năm nay. Dịch vụ này ban đầu sẽ chỉ khả dụng thông qua OpenAI API cho GPT-5.6 Sol và giới hạn cho một số khách hàng chọn lọc. OpenAI dự định sẽ mở rộng quyền truy cập dần dần khi năng lực hệ thống tăng lên. Các công ty muốn tham gia có thể đăng ký nhận thông tin cập nhật thông qua một biểu mẫu.
Tốc độ đầu ra nhanh hơn mở ra những trường hợp sử dụng mới
OpenAI cho biết Ultrafast được thiết kế để kết hợp tốc độ của các mô hình nhỏ hơn với đầy đủ khả năng của một mô hình suy luận lớn, cho phép thực hiện điều mà công ty gọi là "nhiều công việc hữu ích hơn mỗi giây". Ví dụ, trong quá trình ứng phó sự cố, các kỹ sư có thể phân tích nhật ký, thay đổi mã nguồn và báo cáo ngay khi sự cố vẫn đang diễn ra, giúp họ xác định nguyên nhân và chuẩn bị phương án khắc phục theo thời gian thực. OpenAI cho biết họ đã và đang sử dụng mô hình này nội bộ cho mục đích đó.
OpenAI đưa ra một vài kịch bản khác. Trong lĩnh vực tài chính, mô hình có thể đánh giá các tín hiệu thị trường và gắn cờ các giao dịch đáng ngờ ngay khi điều kiện thị trường vẫn đang thay đổi. Trong hỗ trợ khách hàng, các yêu cầu phức tạp có thể được giải quyết theo thời gian thực, ngay cả khi việc tìm ra câu trả lời đòi hỏi nhiều bước hoặc nhiều hệ thống khác nhau. Trong thương mại điện tử, nó có thể trả lời các câu hỏi về sản phẩm, kiểm tra mức tồn kho và cá nhân hóa các đề xuất trước khi một người mua hàng đang do dự rời bỏ giỏ hàng của họ.
Video: Tạo trình mô phỏng kho hàng 3D, hiển thị ở bên trái trong chế độ Ultrafast
Nghiên cứu là một lĩnh vực khác mà OpenAI nhấn mạnh. Các thí nghiệm trước đây vốn phải chạy qua đêm dưới dạng các tác vụ hàng loạt (batch jobs) giờ đây có thể trở thành các phiên làm việc tương tác, cho phép các nhóm kiểm tra ý tưởng, xem xét kết quả, điều chỉnh phương pháp và bắt đầu một lượt chạy mới mà không làm gián đoạn quy trình làm việc.
OpenAI biến tốc độ AI thành đòn bẩy định giá
OpenAI hiện đã thương mại hóa tốc độ suy luận theo các cấp độ. Thông qua API, họ cung cấp "Fast Mode" với cam kết tốc độ nhanh gấp 2,5 lần cùng độ trễ thấp hơn cho GPT-5.6 Sol với mức giá cao gấp đôi. Ultrafast bổ sung thêm một cấp độ thứ ba, nhanh hơn và có khả năng đắt đỏ hơn.
Logic này phản ánh cách làm của các nhà cung cấp dịch vụ đám mây như AWS, vốn từ lâu đã tính phí cao hơn cho cùng một dịch vụ ở các mức hiệu suất cao hơn. OpenAI đang áp dụng điều đó vào suy luận AI. Nếu tốc độ trở thành nút thắt cổ chai trong các ngành công nghiệp, mô hình phân cấp này sẽ mang lại cho OpenAI một phần doanh thu trực tiếp từ những lợi ích mà tốc độ suy luận nhanh hơn tạo ra.
Tin tức AI không thổi phồng – Được tuyển chọn bởi con người
Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.
Đăng ký ngay
Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.