QbitAI
85

Mô hình

Grok 4.6 của Elon Musk trở lại top đầu: Vượt mặt Fable 5 với mức giá cạnh tranh

(giờ Việt Nam)

Tóm tắt AI

Grok 4.6 chính thức trở lại nhóm dẫn đầu với hiệu năng vượt trội và giá thành rẻ hơn Fable 5, đồng thời đánh dấu sự ra mắt của Workbuddy phiên bản từ Musk.

Bản dịch AI

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

13/08/2026 20:04:29 Nguồn: QbitAI

"Workbuddy" phiên bản Elon Musk đã xuất hiện

Elon Musk mang theo Grok 4.6, đưa SpaceXAI trở lại bàn cờ các mô hình ngôn ngữ lớn (LLM).

Nó vượt qua các đối thủ GPT-5.6 Sol và Fable 5 Max trong các bài kiểm tra hiệu năng, nhưng mức giá chỉ 2 USD cho mỗi triệu token đầu vào và 6 USD cho đầu ra, rẻ hơn đáng kể so với hai đối thủ này.

Trong bài kiểm tra GDPVal-AA v2 – thước đo năng lực làm việc thực tế, Grok 4.6 đạt điểm cao nhất là 1753, bỏ xa các đối thủ; đồng thời đứng đầu trong cả hai bài kiểm tra AA-Briefcase và Harvey LAB.

Hiện tại, mô hình mới đã được tích hợp đồng bộ vào Grok Build, Cursor, Grok Bot và API, với ưu đãi gấp đôi hạn mức sử dụng trong tuần đầu tiên trên Cursor.

Trọng tâm của đợt nâng cấp lần này là các tác vụ agent dài hạn, yêu cầu mô hình có thể làm việc liên tục trong thời gian dài mà không bị ngắt quãng khi không có sự giám sát của con người.

Chỉ một ngày trước đó, SpaceXAI cũng đã ra mắt một sản phẩm khác là Grok Bot, một đội ngũ các tác nhân thông minh (agent) có khả năng tự đăng nhập vào nhiều công cụ khác nhau và hoạt động liên tục 24/7.

Hiện tại, Grok Bot đã có thể trực tiếp gọi đến Grok 4.6.

Vừa tung ra Harness, ngay sau đó lại trình làng mô hình mới, nước đi này của Musk cho thấy ông thực sự không muốn bị tụt hậu trong cuộc đua AI.

Giá rẻ hơn, vượt mặt cả Sol và Fable

Bảng điểm chính thức mà SpaceXAI đưa ra lần này bao gồm 10 tiêu chuẩn đánh giá, so sánh với Grok 4.5 High, GPT-5.6 Sol Max và Fable 5 Max.

Về chỉ số trí tuệ tổng hợp AA Intelligence Index, Grok 4.6 đạt 61 điểm, ngang bằng với GPT-5.6 Sol, cao hơn 5 điểm so với mức 56 điểm của Grok 4.5 và chỉ kém 1 điểm so với vị trí dẫn đầu là Fable 5 Max.

Ba hạng mục khác mới là nơi nó thực sự bỏ xa hai đối thủ.

Tại bài kiểm tra GDPVal-AA v2, Grok 4.6 đạt 1753 điểm, vượt qua mức 1728 điểm của GPT-5.6 Sol và 1741 điểm của Fable 5 Max.

Ở hai bài kiểm tra AA-Briefcase và Harvey LAB, Grok 4.6 cũng đều vượt trội với số điểm lần lượt là 1577 và 15,8%.

Tuy nhiên, tại Terminal-Bench v3.0, nó chỉ đạt 26%, trong khi GPT-5.6 Sol đạt 34,6%.

Terminal-Bench đo lường khả năng vận hành agent trong môi trường dòng lệnh thuần túy, nơi mô hình phải thực thi nhiều bước lệnh liên tiếp mà không có giao diện đồ họa, chỉ cần một lỗi nhỏ cũng có thể làm gián đoạn toàn bộ chuỗi tác vụ.

Grok 4.6 chưa làm tốt ở bài kiểm tra này; nó mạnh hơn ở các tác vụ agent liên quan đến tri thức, còn thao tác trên terminal thuần túy thì vẫn chưa bắt kịp.

Nhưng xét đến mức giá của Grok 4.6, thì còn đòi hỏi gì hơn nữa?

Giá niêm yết chính thức của Grok 4.6 là 2 USD cho mỗi triệu token đầu vào và 6 USD cho đầu ra, ngang bằng với Grok 4.5.

Trong cùng phân khúc, GPT-5.6 Sol Max có giá 5 USD và 30 USD, Claude Opus 5 có giá 5 USD và 25 USD, cho thấy Grok 4.6 thực sự có mức giá cạnh tranh hơn.

Tuy nhiên, bảng báo giá này có một dòng chữ nhỏ dễ bị bỏ qua.

Một khi ngữ cảnh (context) của một yêu cầu vượt quá 200.000 token, giá đầu vào và đầu ra sẽ đồng thời tăng gấp đôi lên 4 USD và 12 USD. Điều đáng nói là mức giá này không chỉ áp dụng cho phần vượt quá, mà toàn bộ yêu cầu sẽ được tính theo mức giá cao hơn.

Dù vậy, tính toán kỹ thì ngay cả khi tăng gấp đôi, nó vẫn rẻ hơn so với GPT và Claude.

Ngoài ra, SpaceXAI còn cung cấp một phiên bản độ trễ thấp với giá gấp đôi bản tiêu chuẩn, dành cho các tình huống yêu cầu tốc độ phản hồi cao hơn.

Bốn cổng truy cập đầu tiên của Grok 4.6 bao gồm: Grok Build của chính SpaceXAI, trình soạn thảo mã nguồn Cursor, sản phẩm agent Grok Bot và API mở.

Trên Cursor và Grok Build, SpaceXAI cung cấp ưu đãi gấp đôi hạn mức sử dụng trong một tuần.

Các nền tảng bên thứ ba cũng đã bắt kịp xu hướng với sự tham gia đồng bộ của OpenRouter, Vercel và Cloudflare.

Đáng chú ý là đợt nâng cấp này nhắm vào các tác vụ agent chạy dài hạn như: tra cứu tài liệu trong lĩnh vực lạ, sửa đổi mã nguồn xuyên suốt các thư viện, sử dụng đa dạng công cụ, xây dựng phiên bản đầu tiên và thực hiện nhiều vòng chỉnh sửa dựa trên phản hồi mà không cần phải ngắt quãng để làm lại từ đầu.

Định vị này cũng rất phù hợp với Grok Bot vừa ra mắt hôm qua.

"Workbuddy" phiên bản Elon Musk đã xuất hiện

Nhìn lại sau khi Grok 4.6 ra mắt, Grok Bot được công bố vào rạng sáng ngày 12 rất có thể là bước đệm cho 4.6, với định vị mà SpaceXAI đặt ra là "người đồng đội AI".

Khi đó, Musk đã dự báo rằng Grok 4.6 sẽ ra mắt vào "cuối tuần này", nhưng kết quả là chưa đầy 24 giờ sau nó đã chính thức trình làng.

GrokElon MuskAI ModelsFable 5Công nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.