Mô hình
SpaceXAI ra mắt Grok 4.7: Đỉnh cao lập trình và xử lý tri thức với chi phí từ 2 USD
(giờ Việt Nam)
Tóm tắt AI
SpaceXAI vừa giới thiệu Grok 4.7, mô hình mạnh mẽ nhất của hãng tập trung vào lập trình và xử lý tri thức, sở hữu khả năng quản lý ngữ cảnh dài với mức giá khởi điểm chỉ 2 USD cho mỗi triệu token.
Bản dịch AI
Theo tin từ IT ngày 22 tháng 9, SpaceXAI hôm nay đã công bố ra mắt thế hệ mới Grok 4.7, tập trung vào các tác vụ lập trình và công việc tri thức.
Phía công ty cho biết mô hình này sử dụng nền tảng cơ sở hoàn toàn mới với quy mô lớn hơn, đồng thời được nâng cao khả năng xử lý các tác vụ phức tạp thông qua quá trình huấn luyện học tăng cường kéo dài. Đây là mô hình xử lý tri thức và lập trình mạnh mẽ nhất của công ty tính đến thời điểm hiện tại — với tốc độ nhanh gấp đôi các mô hình cùng loại nhưng mức giá chỉ bằng một nửa.

Như đã đề cập, Grok 4.7 được tối ưu hóa cho các công việc lập trình và tri thức. So với Grok 4.6, mô hình mới có khả năng duy trì hiệu suất ổn định lâu hơn trong các tác vụ khó và tăng cường khả năng tự kiểm tra kết quả đầu ra.
Trong bài kiểm tra CursorBench 4.0, Grok 4.7 dẫn đầu các mô hình cùng loại về tỷ lệ giá thành/hiệu năng đối với các tác vụ lập trình đòi hỏi thời gian chạy dài. Phía công ty cũng cho biết tốc độ vận hành và định giá của mô hình này tương đương với Grok 4.6.

Grok 4.7 sử dụng mô hình cơ sở lớn hơn so với Grok 4.6 và đã trải qua quá trình huấn luyện học tăng cường lâu hơn. Dữ liệu huấn luyện tập trung nhiều hơn vào các tác vụ phức tạp cần hàng giờ để hoàn thành, đồng thời được tối ưu hóa cho khả năng tự xác thực và quản lý ngữ cảnh dài của mô hình.
SpaceXAI cũng đã huấn luyện Grok 4.7 một cách nguyên bản (natively) trên Grok Bot harness, giúp cải thiện hiệu suất trong các tác vụ đối thoại và công việc tri thức thông thường. Ngoài ra, mô hình này cũng có những cải tiến trong việc tạo tài liệu và bản trình bày (presentation).

Trong hai bài kiểm tra chuẩn GDPval và AA Briefcase, Grok 4.7 đều cho thấy sự cải thiện so với Grok 4.6. Các bài kiểm tra này yêu cầu AI hoàn thành những tác vụ liên quan đến công việc hàng ngày của các chuyên gia như luật sư, y tá, chuyên gia phân tích tài chính, v.v. Phía công ty cho biết hiệu suất của Grok 4.7 trong hai bài kiểm tra này đã đạt đến mức tương đương với các mô hình tiên tiến khác.

Về khía cạnh an toàn, SpaceXAI đã áp dụng một hệ thống bảo vệ an toàn hoàn toàn mới cho Grok 4.7. Công ty cho biết mô hình này đã đạt mức cao nhất trong các thử nghiệm nội bộ về khả năng từ chối trả lời và chống lại các cuộc tấn công "jailbreak".

Trong các kịch bản có mục đích kép như an ninh mạng và lĩnh vực sinh học, Grok 4.7 cố gắng cân bằng giữa tính khả dụng cho các tác vụ hợp pháp và khả năng từ chối an toàn đối với các tác vụ nguy hiểm. Trong bài kiểm tra an toàn sinh học LatchBio, mô hình đạt kết quả 62,4%.

Đối với các kịch bản an ninh mạng, SpaceXAI cho biết trong bài kiểm tra HackerBench v0.3, Grok 4.7 chỉ cho phép 3,3% các câu lệnh (prompt) có mục đích kép rủi ro cao được thông qua, đồng thời hạn chế việc chặn nhầm các công việc bảo mật hợp pháp. Ngoài ra, công ty đã bắt đầu cung cấp quyền truy cập theo lời mời cho một số đối tác an ninh mạng để phục vụ nghiên cứu phòng thủ và khả năng red-teaming.
Hiện tại, Grok 4.7 đã có sẵn thông qua Cursor và Grok Build, đồng thời mở Grok API, hỗ trợ các công cụ lập trình bên thứ ba, dịch vụ định tuyến mô hình và các nền tảng đám mây.
Về giá cả, Grok 4.7 có giá khởi điểm 2 USD cho mỗi triệu token đầu vào (Ghi chú của IT: tỷ giá hiện tại tương đương khoảng 13,4 Nhân dân tệ) và 6 USD cho mỗi triệu token đầu ra (tương đương khoảng 40,2 Nhân dân tệ). SpaceXAI cũng cung cấp phiên bản tốc độ cao với tốc độ đầu ra gấp đôi, nhưng mức giá cũng sẽ tăng gấp đôi.
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.