← Về bảng nóng
SỰ KIỆNĐã lắng xuống

Grok 4.6 dẫn đầu nhiều bảng xếp hạng tiêu chuẩn

Tổng quan sự kiện

Toàn cảnh do AI tổng thuật

SpaceXAI ra mắt mô hình Grok 4.6, vươn lên dẫn đầu nhiều bảng xếp hạng tiêu chuẩn. Mô hình này đạt 61 điểm trên chỉ số Artificial Analysis, ngang bằng với GPT-5.6 Sol và chỉ xếp sau dòng Claude của Anthropic. Trên bảng xếp hạng GDPval-AA v2, mô hình đạt 1753 Elo, đứng vị trí số 1; đồng thời dẫn đầu tại các bài kiểm tra như AA-Briefcase và Harvey LAB, cũng như xếp thứ hai tại CursorBench, FrontierCode, APEX-Agents và APEX-SWE.

Giá của Grok 4.6 tương đương với Grok 4.5, ở mức 2 USD cho mỗi triệu token đầu vào và 6 USD cho đầu ra, giúp tiết kiệm hơn 60% chi phí so với Claude Opus 5 và GPT-5.6 Sol. Mô hình đã có mặt trên toàn bộ các nền tảng Cursor, grok Build và OpenRouter, với ưu đãi gấp đôi hạn mức trong tuần đầu tiên.

Mô hình này được tăng cường khả năng xử lý các tác vụ tác tử (agent) chạy dài hạn, cải thiện năng lực phân tích xuyên suốt kho mã nguồn và tự kiểm chứng, đồng thời tối ưu hóa các tương tác phức tạp và công việc liên quan đến thị giác. Cửa sổ ngữ cảnh đạt 500k token với chi phí 0,84 USD mỗi tác vụ.

Tổng thuật do AI tổng hợp từ toàn bộ bài đưa tin, cập nhật theo diễn biến · làm mới T6 · 14/08 · 07:25.

Diễn biến mới nhất

Grok 4.6 dẫn đầu nhiều bài kiểm tra đánh giá hiệu năng, giữ nguyên mức giá và đã chính thức có mặt trên đa nền tảng.

Chính chủ · 1 bài

Nghe trực tiếp từ bên liên quan

Lọc toàn bộ bài chính chủ trong dòng thời gian →

Dòng thời gian đưa tin

Đang hiện 7 bài · tất cả · mới trước

T5 · 13/08

  1. Grok 4.6 của xAI ngang tầm với mô hình tốt nhất từ OpenAI nhưng có mức giá cạnh tranh hơn

    The Decoder: AI News
    Đọc bài gốc ↗
  2. Grok 4.6 của SpaceXAI đạt 61 điểm trên "Chỉ số phân tích trí tuệ nhân tạo"

    Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)

    Grok 4.6 của SpaceXAI đạt 61 điểm trên chỉ số phân tích trí tuệ nhân tạo, ngang bằng với GPT-5.6 Sol và chỉ xếp sau Claude Opus 5 và Claude Fable 5. Hiệu suất tác tử của mô hình rất ấn tượng với 1753 Elo trên GDPval-AA v2. Mức giá duy trì ở mức 2 USD/6 USD cho mỗi triệu token, thấp hơn 60% so với Claude Opus 5 và GPT-5.6 Sol. Cửa sổ ngữ cảnh đạt 500k token với chi phí 0,84 USD mỗi tác vụ.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  3. Cursor và SpaceXAI hợp tác ra mắt Grok 4.6

    Cursor BlogChính chủ

    Cursor và SpaceXAI hôm nay đã ra mắt Grok 4.6, tập trung tăng cường các tác tử chạy dài hạn và tác vụ thị giác tương tác. Mô hình đạt trình độ tiên tiến trên nhiều bảng xếp hạng về lập trình tác tử và tri thức, đồng thời bắt kịp GPT-5.6 Sol trên chỉ số Artificial Analysis Intelligence Index.

    Đọc bản tiếng Việt →Đọc bài gốc ↗

T4 · 12/08

  1. Ra mắt Grok 4.6: Giữ nguyên giá, trí tuệ vươn lên nhóm dẫn đầu

    X: AI Notes (@AYi_AInotes)

    Grok 4.6 chính thức ra mắt, giữ nguyên mức giá như bản 4.5 ($2/triệu token đầu vào, $6/triệu token đầu ra), trí tuệ cải thiện vượt bậc với chỉ số AA đạt 61 điểm, ngang bằng với GPT-5.6 Sol Max và chỉ thấp hơn Fable 5 đúng 1 điểm. Mô hình đã có mặt trên toàn bộ các nền tảng Cursor, Grok Build và OpenRouter. Người dùng được hưởng gấp đôi hạn mức trong tuần đầu tiên, đồng thời khả năng phân tích đa kho lưu trữ mã nguồn và tự kiểm chứng đã được nâng cấp cho các tác vụ Agent chạy dài hạn.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  2. Quyết đấu GPT-5.6 Sol, SpaceXAI ra mắt mô hình Grok 4.6

    IT Home

    SpaceXAI ra mắt Grok 4.6, tăng cường khả năng xử lý cho các tác vụ Agent chạy dài hạn, tương tác phức tạp và công việc liên quan đến thị giác. Trên bảng xếp hạng Artificial Analysis Intelligence Index tổng hợp từ 9 bài kiểm tra tiêu chuẩn, Grok 4.6 đạt kết quả ngang bằng với GPT-5.6 Sol.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  3. Grok 4.6 chính thức ra mắt, dẫn đầu nhiều bảng xếp hạng chuẩn

    X: cb_doge (@cb_doge)

    Grok 4.6 là một bản nâng cấp quan trọng 🚀. Mô hình này đã vượt qua Grok 4.5 High trong mọi bài kiểm tra chuẩn được liệt kê, với thứ hạng hiện tại như sau: 🥇 #1 GDPVal-AA v2 — 1.753 điểm, 🥇 #1 AA-Briefcase — 1.577 điểm, 🥇 #1 Harvey LAB — 15,8%, 🥈 #2 CursorBench — 69,9%, 🥈 #2 FrontierCode — 61,3%, 🥈 #2 APEX-Agents — 57,5%, 🥈 #2 APEX-SWE — 56,4%. Trên bảng xếp hạng Artificial Analysis Intelligence Index, mô hình này đạt 61 điểm, ngang bằng với GPT-5.6 Sol Max. Grok 4.6 hiện đã có sẵn trên Cursor và Grok Build, với lưu lượng sử dụng tăng gấp đôi ngay trong tuần đầu tiên.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  4. Grok 4.6 dẫn đầu làn sóng trí tuệ nhân tạo với hiệu suất tác tử vượt trội

    X: Artificial Analysis (@ArtificialAnlys)

    Grok 4.6 của xAI vừa đạt 61 điểm trên bảng xếp hạng trí tuệ của Artificial Analysis, ngang hàng với GPT-5.6 Sol ở vị trí dẫn đầu và chỉ xếp sau dòng Claude của Anthropic. Mẫu AI này thể hiện hiệu suất vượt trội với chỉ số GDPval-AA v2 Elo đạt 1753. Đáng chú ý, mức giá của Grok 4.6 vẫn được giữ nguyên ở mức 2 USD/6 USD cho mỗi triệu token, giúp tối ưu chi phí thấp hơn tới 60% so với Claude Opus 5 và GPT-5.6 Sol.

    Đọc bản tiếng Việt →Đọc bài gốc ↗

Sự kiện liên quan

← Về bảng nóng

Hồ sơ sự kiện được gom từ nhiều nguồn đưa tin độc lập rồi dịch, tóm tắt sang tiếng Việt. Bản quyền từng bài viết thuộc về cơ quan báo chí gốc. Nguồn dữ liệu: hồ sơ gốc trên AI HOT

Grok 4.6 dẫn đầu nhiều bảng xếp hạng tiêu chuẩn — Hồ sơ sự kiện | AIHOT.vn