IT Home
85

Mô hình

Cựu chuyên gia OpenAI thành lập TypeSafe AI, ra mắt Jev - mô hình ra quyết định không tạo văn bản

(giờ Việt Nam)

Tóm tắt AI

TypeSafe AI vừa giới thiệu Jev, mô hình tập trung vào việc đưa ra các quyết định có cấu trúc thay vì tạo văn bản. Với chi phí cực thấp, Jev hứa hẹn tối ưu hóa quy trình ra quyết định cho các hệ thống AI.

Bản dịch AI

Theo tin từ IT ngày 17 tháng 9, TypeSafe AI đã đưa ra thông báo vào ngày hôm qua (16 tháng 9) về việc ra mắt Jev. Mô hình AI này được định vị là "System One Model" (mô hình hệ thống 1), không tạo văn bản mà trả về trực tiếp các quyết định có cấu trúc, với chi phí và độ trễ thấp hơn nhiều so với các mô hình ngôn ngữ lớn (LLM).

Theo dữ liệu công khai mà IT tra cứu, TypeSafe AI được thành lập bởi Diogo Almeida, cựu nhân viên OpenAI và là một trong những người đứng sau nghiên cứu RLHF – nền tảng tạo nên ChatGPT. Công ty được thành lập cách đây 2 năm và tuần này đã chính thức kết thúc giai đoạn hoạt động bí mật, đồng thời công bố hoàn tất vòng gọi vốn hạt giống trị giá 40 triệu USD (lưu ý của IT: tỷ giá hiện tại tương đương khoảng 269 triệu nhân dân tệ) do DCVC dẫn đầu.

Công ty định nghĩa Jev là "System One Model", tương ứng với các kịch bản ra quyết định lặp đi lặp lại với tốc độ nhanh và độ trễ thấp. Định nghĩa này mượn khái niệm "Hệ thống 1" trong tâm lý học, chỉ khả năng phán đoán nhanh và trực giác. Loại mô hình này hướng tới các tác vụ ra quyết định lặp lại như chọn phương án cố định, chấm điểm liên tục hoặc xác suất có/không, thay vì lấy việc tạo văn bản ngôn ngữ tự nhiên, mã nguồn hay hội thoại nhiều vòng làm hình thức đầu ra chính.

Jev không tạo ra chuỗi ngôn ngữ tự nhiên hay mã nguồn. Đầu ra của nó bao gồm 3 loại nguyên hàm (primitive) cố định:

Choice (Lựa chọn): Một trong những nguyên hàm đầu ra có cấu trúc mà Jev cung cấp. Mô hình chọn 1 mục từ tập hợp các tùy chọn được xác định trước (hỗ trợ tối đa 255 tùy chọn) và trả về phân phối xác suất hoặc độ tin cậy tương ứng cho từng tùy chọn.

Score (Chấm điểm): Dựa trên nội dung đầu vào, mô hình đưa ra điểm số trong phạm vi giá trị được chỉ định kèm theo thông tin về độ tin cậy. Bài viết lấy ví dụ về điểm rủi ro khách hàng rời bỏ trong phạm vi từ 0 đến 1, các kịch bản áp dụng bao gồm phân loại rủi ro, sắp xếp hồ sơ và gắn nhãn dữ liệu hàng loạt.

Noul (Xác suất Boolean): Mô hình trả về xác suất có/không đã được hiệu chuẩn cùng độ tin cậy cho các câu hỏi đặt trước, có thể dùng để thực hiện xác thực lần hai đối với kết quả của các mô hình khác, nhận diện các kết luận có độ tin cậy thấp và thiết lập các nhánh điều kiện trong quy trình làm việc tự động.

Về phương pháp huấn luyện nền tảng, phía công ty cho biết Jev sử dụng "Reinforcement Learning from Calibrated Decisions" (RLCD - Học tăng cường từ các quyết định đã hiệu chuẩn), với mục tiêu tối ưu hóa mối tương quan giữa độ tin cậy của mô hình và tỷ lệ chính xác thực tế. Ví dụ, khi mô hình đưa ra độ tin cậy 70% trong nhiều dự đoán, về lý thuyết khoảng 70% các dự đoán liên quan sẽ đúng. Phương pháp này có thể dùng cho chấm điểm rủi ro, phân luồng kiểm duyệt và xác thực đầu ra của mô hình.

Công ty tuyên bố rằng đối với các tác vụ có cấu trúc tương tự, Jev nhanh hơn từ 20 đến 200 lần và có chi phí thấp hơn từ 40 đến 400 lần so với các mô hình ngôn ngữ lớn tiên tiến nhất hiện nay.

Giá cho mỗi triệu Token đầu vào là 0,042 USD (tỷ giá hiện tại tương đương khoảng 0,28 nhân dân tệ), trong khi Token đầu ra thực tế là miễn phí do không tồn tại quá trình tạo tự hồi quy (autoregressive).

Dữ liệu kiểm chuẩn (benchmark) do TypeSafe công bố cho thấy tốc độ tăng tối đa 193,6 lần và chi phí giảm tối đa 444,6 lần, tuy nhiên công ty cũng thừa nhận rằng những con số này đại diện cho giới hạn hiệu suất thực tế.

Để chứng minh khả năng ra quyết định theo thời gian thực, công ty đã đăng tải một đoạn video Jev chơi game "Doom" với tần suất gọi lệnh khoảng 10 lần mỗi giây, chi phí chơi game mỗi giờ khoảng 7 USD (tỷ giá hiện tại tương đương khoảng 47,1 nhân dân tệ). Trong một bài kiểm chuẩn điều hướng liên kết Wikipedia, tốc độ hoàn thành tác vụ của Jev đã vượt qua nhiều mô hình tiên tiến đang chạy ở chế độ không suy luận tốc độ cao.

AIJevOpenAIMô hình AICông nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.