Grok 4.6 dẫn đầu nhiều bảng xếp hạng tiêu chuẩn
Tổng quan sự kiện
Toàn cảnh do AI tổng thuật
SpaceXAI ra mắt mô hình Grok 4.6, vươn lên dẫn đầu nhiều bảng xếp hạng tiêu chuẩn. Mô hình này đạt 61 điểm trên chỉ số Artificial Analysis, ngang bằng với GPT-5.6 Sol và chỉ xếp sau dòng Claude của Anthropic. Trên bảng xếp hạng GDPval-AA v2, mô hình đạt 1753 Elo, đứng vị trí số 1; đồng thời dẫn đầu tại các bài kiểm tra như AA-Briefcase và Harvey LAB, cũng như xếp thứ hai tại CursorBench, FrontierCode, APEX-Agents và APEX-SWE.
Giá của Grok 4.6 tương đương với Grok 4.5, ở mức 2 USD cho mỗi triệu token đầu vào và 6 USD cho đầu ra, giúp tiết kiệm hơn 60% chi phí so với Claude Opus 5 và GPT-5.6 Sol. Mô hình đã có mặt trên toàn bộ các nền tảng Cursor, grok Build và OpenRouter, với ưu đãi gấp đôi hạn mức trong tuần đầu tiên.
Mô hình này được tăng cường khả năng xử lý các tác vụ tác tử (agent) chạy dài hạn, cải thiện năng lực phân tích xuyên suốt kho mã nguồn và tự kiểm chứng, đồng thời tối ưu hóa các tương tác phức tạp và công việc liên quan đến thị giác. Cửa sổ ngữ cảnh đạt 500k token với chi phí 0,84 USD mỗi tác vụ.
Tổng thuật do AI tổng hợp từ toàn bộ bài đưa tin, cập nhật theo diễn biến · làm mới T6 · 14/08 · 07:25.
Diễn biến mới nhất
Grok 4.6 dẫn đầu nhiều bài kiểm tra đánh giá hiệu năng, giữ nguyên mức giá và đã chính thức có mặt trên đa nền tảng.
Chính chủ · 1 bài
Nghe trực tiếp từ bên liên quan
- Cursor BlogCursor và SpaceXAI hợp tác ra mắt Grok 4.6
Dòng thời gian đưa tin
Đang hiện 7 bài · tất cả · mới trước
T5 · 13/08
Grok 4.6 của xAI ngang tầm với mô hình tốt nhất từ OpenAI nhưng có mức giá cạnh tranh hơn
The Decoder: AI NewsGrok 4.6 của SpaceXAI đạt 61 điểm trên "Chỉ số phân tích trí tuệ nhân tạo"
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)Grok 4.6 của SpaceXAI đạt 61 điểm trên chỉ số phân tích trí tuệ nhân tạo, ngang bằng với GPT-5.6 Sol và chỉ xếp sau Claude Opus 5 và Claude Fable 5. Hiệu suất tác tử của mô hình rất ấn tượng với 1753 Elo trên GDPval-AA v2. Mức giá duy trì ở mức 2 USD/6 USD cho mỗi triệu token, thấp hơn 60% so với Claude Opus 5 và GPT-5.6 Sol. Cửa sổ ngữ cảnh đạt 500k token với chi phí 0,84 USD mỗi tác vụ.
Cursor và SpaceXAI hợp tác ra mắt Grok 4.6
Cursor BlogChính chủCursor và SpaceXAI hôm nay đã ra mắt Grok 4.6, tập trung tăng cường các tác tử chạy dài hạn và tác vụ thị giác tương tác. Mô hình đạt trình độ tiên tiến trên nhiều bảng xếp hạng về lập trình tác tử và tri thức, đồng thời bắt kịp GPT-5.6 Sol trên chỉ số Artificial Analysis Intelligence Index.
T4 · 12/08
Ra mắt Grok 4.6: Giữ nguyên giá, trí tuệ vươn lên nhóm dẫn đầu
X: AI Notes (@AYi_AInotes)Grok 4.6 chính thức ra mắt, giữ nguyên mức giá như bản 4.5 ($2/triệu token đầu vào, $6/triệu token đầu ra), trí tuệ cải thiện vượt bậc với chỉ số AA đạt 61 điểm, ngang bằng với GPT-5.6 Sol Max và chỉ thấp hơn Fable 5 đúng 1 điểm. Mô hình đã có mặt trên toàn bộ các nền tảng Cursor, Grok Build và OpenRouter. Người dùng được hưởng gấp đôi hạn mức trong tuần đầu tiên, đồng thời khả năng phân tích đa kho lưu trữ mã nguồn và tự kiểm chứng đã được nâng cấp cho các tác vụ Agent chạy dài hạn.
Quyết đấu GPT-5.6 Sol, SpaceXAI ra mắt mô hình Grok 4.6
IT HomeSpaceXAI ra mắt Grok 4.6, tăng cường khả năng xử lý cho các tác vụ Agent chạy dài hạn, tương tác phức tạp và công việc liên quan đến thị giác. Trên bảng xếp hạng Artificial Analysis Intelligence Index tổng hợp từ 9 bài kiểm tra tiêu chuẩn, Grok 4.6 đạt kết quả ngang bằng với GPT-5.6 Sol.
Grok 4.6 chính thức ra mắt, dẫn đầu nhiều bảng xếp hạng chuẩn
X: cb_doge (@cb_doge)Grok 4.6 là một bản nâng cấp quan trọng 🚀. Mô hình này đã vượt qua Grok 4.5 High trong mọi bài kiểm tra chuẩn được liệt kê, với thứ hạng hiện tại như sau: 🥇 #1 GDPVal-AA v2 — 1.753 điểm, 🥇 #1 AA-Briefcase — 1.577 điểm, 🥇 #1 Harvey LAB — 15,8%, 🥈 #2 CursorBench — 69,9%, 🥈 #2 FrontierCode — 61,3%, 🥈 #2 APEX-Agents — 57,5%, 🥈 #2 APEX-SWE — 56,4%. Trên bảng xếp hạng Artificial Analysis Intelligence Index, mô hình này đạt 61 điểm, ngang bằng với GPT-5.6 Sol Max. Grok 4.6 hiện đã có sẵn trên Cursor và Grok Build, với lưu lượng sử dụng tăng gấp đôi ngay trong tuần đầu tiên.
Grok 4.6 dẫn đầu làn sóng trí tuệ nhân tạo với hiệu suất tác tử vượt trội
X: Artificial Analysis (@ArtificialAnlys)Grok 4.6 của xAI vừa đạt 61 điểm trên bảng xếp hạng trí tuệ của Artificial Analysis, ngang hàng với GPT-5.6 Sol ở vị trí dẫn đầu và chỉ xếp sau dòng Claude của Anthropic. Mẫu AI này thể hiện hiệu suất vượt trội với chỉ số GDPval-AA v2 Elo đạt 1753. Đáng chú ý, mức giá của Grok 4.6 vẫn được giữ nguyên ở mức 2 USD/6 USD cho mỗi triệu token, giúp tối ưu chi phí thấp hơn tới 60% so với Claude Opus 5 và GPT-5.6 Sol.