Grok 4.7 ra mắt, tuyên bố thông minh và mạnh mẽ hơn trong khi vẫn giữ nguyên tốc độ và chi phí
Tổng quan sự kiện
Tóm tắt sự kiện · Thông tin xác thực
Grok 4.7 đã chính thức được phát hành. Phiên bản này được tuyên bố là thông minh và có năng lực vượt trội hơn thế hệ tiền nhiệm, đồng thời duy trì tốc độ và chi phí ở mức tương đương; đây là thông tin từ phía nhà phát hành và chưa được kiểm chứng độc lập.
Theo bài gốc của sự kiện từ X: Michael Truell (@mntruell).
Diễn biến mới nhất
Báo cáo đánh giá: Grok 4.7 xếp hạng ngay sau các mô hình của Anthropic trên AA-Briefcase, chỉ kém hơn Opus 5 một chút với chi phí mỗi tác vụ bằng khoảng 50%; trong bản Lite, điểm Elo chất lượng phân tích tăng từ 1698 lên 1994, điểm Elo trình bày giảm nhẹ xuống 1499, chi phí API khoảng 8 USD, cao hơn mức 4,40 USD của Grok 4.6.
Chính chủ · 9 bài
Nghe trực tiếp từ bên liên quan
- X: Arena (@arena)Theo bài viết, Grok 4.7 (xHigh) đã đạt 1632 điểm, xếp thứ 10 trên bảng xếp hạng Code Arena: WebDev, tăng 16 điểm và thăng 6 bậc so với phiên bản Grok 4.6 (High)
- X: Artificial Analysis (@ArtificialAnlys)Báo cáo đánh giá: Grok 4.7 xếp hạng ngay sau các mô hình của Anthropic trên AA-Briefcase, chỉ kém hơn Opus 5 một chút với chi phí mỗi tác vụ bằng khoảng 50%; trong bản Lite, điểm Elo chất lượng phân tích tăng từ 1698 lên 1994, điểm Elo trình bày giảm nhẹ xuống 1499, chi phí API khoảng 8 USD, cao hơn mức 4,40 USD của Grok 4.6
Dòng thời gian đưa tin
Đang hiện 20 bài · tất cả · mới trước
Hôm nay · 23/09
Theo bài viết, Grok 4.7 (xHigh) đã đạt 1632 điểm, xếp thứ 10 trên bảng xếp hạng Code Arena: WebDev, tăng 16 điểm và thăng 6 bậc so với phiên bản Grok 4.6 (High)
X: Arena (@arena)Chính chủTheo bài viết, Grok 4.7 (xHigh) của @SpaceXAI vừa lọt vào top 10 bảng xếp hạng Code Arena: WebDev với 1632 điểm, tăng 16 điểm và thăng 6 bậc so với thế hệ tiền nhiệm Grok 4.6 (High) (phiên bản cũ hiện xếp thứ 16 với 1616 điểm). Tác giả cho biết hiệu suất ở các lĩnh vực chuyên biệt cũng được cải thiện: Simulations tăng từ hạng 13 lên hạng 5, Consumer Product tăng từ hạng 12 lên hạng 8. Đây là kết quả bảng xếp hạng do tác giả báo cáo, không phải thông báo chính thức.
Hôm qua · 22/09
xAI ra mắt mô hình flagship Grok 4.7: Nền tảng lớn hơn cùng quá trình huấn luyện RL kéo dài, giữ nguyên mức giá $2/$6, khả dụng thông qua xAI API, Cursor, Grok Build, OpenRouter, Vercel và Cloudflare
MarkTechPostxAI vừa phát hành Grok 4.7, mô hình flagship mới phục vụ lập trình, tác vụ đại lý (agent) và công việc tri thức. Được xây dựng trên nền tảng mô hình lớn hơn cùng quá trình huấn luyện tăng cường (RL) kéo dài, Grok 4.7 duy trì mức giá và tốc độ tương đương Grok 4.6 (đầu vào $2/triệu token, đầu ra $6/triệu token). Mô hình cung cấp cửa sổ ngữ cảnh 500K và các cấp độ suy luận lên đến xhigh, có thể truy cập qua xAI API, Cursor (tất cả các gói), Grok Build (mô hình mặc định), OpenRouter, Vercel và Cloudflare; ngoài ra còn có các điểm cuối (endpoint) tại khu vực Mỹ với mức phí cao hơn 10%. Theo dữ liệu tự công bố, mô hình dẫn đầu trong các bài kiểm tra EEBench và Harvey (pháp lý), trong khi Fable 5.1 Max vẫn dẫn trước ở 4 trên 7 tiêu chuẩn đánh giá. Bộ công cụ an toàn mới đạt 62,4% trong bài kiểm tra an toàn sinh học LatchBio, chỉ để lọt 3,3% các gợi ý rủi ro lưỡng dụng trong HackerBench v0.3; một số đối tác an ninh mạng sẽ được mời tham gia thử nghiệm red team.
Báo cáo đánh giá: Grok 4.7 xếp hạng ngay sau các mô hình của Anthropic trên AA-Briefcase, chỉ kém hơn Opus 5 một chút với chi phí mỗi tác vụ bằng khoảng 50%; trong bản Lite, điểm Elo chất lượng phân tích tăng từ 1698 lên 1994, điểm Elo trình bày giảm nhẹ xuống 1499, chi phí API khoảng 8 USD, cao hơn mức 4,40 USD của Grok 4.6
X: Artificial Analysis (@ArtificialAnlys)Chính chủTác giả báo cáo kết quả của Grok 4.7 trong kịch bản đánh giá thẩm định công khai AA-Briefcase/AA-Briefcase-Lite (yêu cầu mô hình xây dựng mô hình thị trường và bộ tài liệu đánh giá mục tiêu): xếp hạng chỉ đứng sau các mô hình của Anthropic, kém hơn Opus 5 một chút, với chi phí mỗi tác vụ bằng khoảng 50% so với Opus 5; so với Grok 4.6, điểm Elo chất lượng phân tích tăng từ 1698 lên 1994, điểm Elo trình bày giảm nhẹ từ 1531 xuống 1499; chi phí API để tạo bộ tài liệu mẫu khoảng 8 USD (xhigh), cao hơn mức khoảng 4,40 USD của Grok 4.6 (xhigh).
SpaceXAI ra mắt mô hình lập trình và xử lý tri thức Grok 4.7, giá khởi điểm 2 USD cho mỗi triệu token đầu vào, hiện đã có sẵn thông qua Cursor, Grok Build và API
IT HomeSpaceXAI công bố ra mắt thế hệ Grok 4.7 mới, tập trung vào các tác vụ lập trình và xử lý tri thức. Theo công bố chính thức, mô hình sử dụng nền tảng lớn hơn và được huấn luyện tăng cường kỹ lưỡng hơn, trở thành mô hình lập trình và xử lý tri thức mạnh mẽ nhất hiện nay. Cùng với việc ra mắt, hãng cũng công bố nhiều kết quả kiểm thử tiêu chuẩn và bảo mật, cho phép đối tác an ninh mạng truy cập theo hình thức mời, đồng thời cho biết mô hình đã có sẵn thông qua Cursor, Grok Build và Grok API với giá khởi điểm 2 USD cho mỗi triệu token đầu vào và 6 USD cho mỗi triệu token đầu ra. Các kết quả và tuyên bố "mạnh nhất" đều dựa trên thông tin từ phía nhà sản xuất.
x.ai vừa ra mắt mô hình Grok 4.7. Người dùng có thể trải nghiệm ngay trong ngày thông qua Cursor, Grok Build và Grok API với mức giá và tốc độ tương đương Grok 4.6
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)x.ai công bố phát hành mô hình Grok 4.7, khẳng định đây là mô hình mạnh mẽ nhất hiện nay trong lĩnh vực lập trình và tri thức. Mô hình này sử dụng nền tảng mới lớn hơn và có khả năng hiểu nguyên bản (natively understand) Grok Bot harness. Về giá cả và tốc độ, Grok 4.7 giữ nguyên thông số như Grok 4.6, với giá khởi điểm 2 USD cho mỗi triệu token đầu vào và 6 USD cho mỗi triệu token đầu ra; hãng cũng cung cấp thêm phiên bản "tốc độ nhanh" với mức giá gấp đôi. Mô hình đã có mặt trên Cursor, Grok Build, đồng thời được cung cấp thông qua Grok API, các khung lập trình bên thứ ba, bộ định tuyến mô hình và các nền tảng đám mây. Bên cạnh đó, x.ai cũng công bố nhiều kết quả kiểm thử, khẳng định mô hình dẫn đầu về hiệu năng trên giá thành tại CursorBench 4.0. Nhờ áp dụng bộ khung bảo mật hoàn toàn mới, Grok 4.7 đạt 62,4% trên thang đo an toàn sinh học LatchBio, chỉ cho phép thực thi 3,3% các yêu cầu rủi ro cao trên HackerBench v0.3 và đã bắt đầu cấp quyền truy cập thử nghiệm (red teaming) theo diện mời cho một số đối tác an ninh mạng.
Grok 4.7 đạt 19,6% điểm trong bài kiểm tra Harvey Legal Agent Benchmark, vượt xa mức 2,5% của GPT-5.6 Sol Max và 6,7% của Fable 5.1 Max
X: Rohan Paul (@rohanpaul_ai)Theo bài viết, Grok 4.7 của SpaceXAI đạt 19,6% điểm trong Harvey Legal Agent Benchmark, trong khi GPT-5.6 Sol Max đạt 2,5% và Fable 5.1 Max đạt 6,7%; tài liệu gốc cho biết lĩnh vực pháp lý là một trong những mảng có sự cải thiện rõ rệt nhất của Grok 4.7.
Grok 4.7 đã chính thức ra mắt trên Grok Build, Cursor và API. Hiệu suất của phiên bản này trong các tác vụ cụ thể tiệm cận với Opus 5, trong khi mức giá vẫn giữ nguyên như Grok 4.6
X: Testing Catalog (@testingcatalog)Theo bài đăng, Grok 4.7 đã được phát hành trên Grok Build, nền tảng Cursor và API. Tác giả cho biết hiệu suất của mô hình này trong các tác vụ cụ thể đạt mức gần bằng Opus 5, với giá thành tương đương Grok 4.6, đồng thời khẳng định sẽ sớm tiến hành các bài kiểm tra đánh giá.
Model card của Grok 4.7 cho thấy nhiều chỉ số benchmark được cải thiện so với bản 4.6, trong khi giá thành vẫn giữ nguyên
X: Eric Zakariasson (@ericzakariasson)Tài liệu công bố model card của Grok 4.7 cho thấy nhiều kết quả benchmark đã tăng so với Grok 4.6: Terminal-Bench tăng từ 20,3% lên 38,0%, SWE-Marathon tăng từ 31,9% lên 46,0%, HealthBench Pro tăng từ 48,5% lên 56,7%, Legal Agent tăng từ 15,8% lên 19,6%, EEBench tăng từ 60,0% lên 66,0%, với mức giá không đổi so với bản 4.6.
Grok 4.7 giảm giá 30% trong tuần tới
X: opencode (@opencode)Chính chủTheo thông tin gốc, Grok 4.7 sẽ được giảm giá 30% trong tuần tới, đây là chương trình ưu đãi có giới hạn thời gian.
Grok 4.7 xếp thứ ba về khả năng lập trình tác tử (agentic coding), chỉ đứng sau Anthropic và OpenAI
X: Elon Musk (@elonmusk, xAI)Theo bản tin gốc, Grok 4.7 đứng thứ ba về khả năng lập trình tác tử (agentic coding), xếp sau Anthropic và OpenAI. Tác giả cho rằng, xét đến tốc độ vượt trội và chi phí thấp hơn, đây là lựa chọn đáng cân nhắc cho công việc hàng ngày. Bảng xếp hạng này dựa trên đánh giá của tác giả, bài viết gốc không nêu rõ tên phương pháp đánh giá hay thời điểm thực hiện.
@SpaceXAI phát hành mô hình Grok 4.7
X: Arena (@arena)Chính chủTác giả cho biết mô hình Grok 4.7 của @SpaceXAI vừa được ra mắt. Bài viết đề cập đến việc kết hợp xu hướng cải thiện điểm số ròng của các phiên bản Grok trước đó trên Agent Arena, đồng thời mời người dùng bình chọn dự đoán kết quả của bản 4.7; điểm số sẽ được công bố sau khi quá trình bình chọn kết thúc.
T2 · 21/09
xAI ra mắt Grok 4.7 với giá 2 USD/6 USD mỗi triệu token, hiệu suất chuẩn thấp hơn Claude Fable 5.1 và GPT-6
The Decoder: AI NewsTheo thông tin gốc, xAI đã giới thiệu Grok 4.7 – mô hình mạnh mẽ nhất từ trước đến nay của hãng trong lĩnh vực lập trình và xử lý tri thức. Công ty cho biết mô hình này dựa trên nền tảng lớn hơn, được huấn luyện thông qua học tăng cường (reinforcement learning) lâu hơn và có khả năng tự kiểm chứng đầu ra tốt hơn. Mức giá được ấn định là 2 USD cho mỗi triệu token đầu vào và 6 USD cho mỗi triệu token đầu ra, hiện đã có thể sử dụng qua Grok API, Cursor và Grok Build. Trên bảng xếp hạng Artificial Analysis Intelligence Index (v4.3.2), mô hình đạt 46 điểm trong tổng hợp 10 bài kiểm tra chuẩn, xếp ở mức trung bình và đứng sau Claude Fable 5.1 cùng GPT-6 (cùng đạt 53 điểm). Trong bài kiểm tra lập trình tác nhân Terminal-Bench 4.0, Grok 4.7 chỉ đạt 26%, thấp hơn mức 60% của GPT-6 Astra, 55% của Claude Fable 5.1 và 27% của DeepSeek V4.1 Flash.
Tác giả đánh giá Grok 4.7 (xhigh): Đạt 46 điểm Intelligence Index, tăng 2 điểm so với Grok 4.6, đưa SpaceXAI lọt vào top 4 phòng thí nghiệm AI; đạt 56 điểm Coding Agent Index, vượt qua GPT-5.6 Sol
X: Artificial Analysis (@ArtificialAnlys)Chính chủTác giả đánh giá phiên bản Grok 4.7 mới phát hành (với cường độ suy luận xhigh): Đạt 46 điểm trên Artificial Analysis Intelligence Index, tăng 2 điểm so với Grok 4.6, giúp SpaceXAI lọt vào top 4 phòng thí nghiệm AI hàng đầu; đạt 56 điểm Coding Agent Index (xhigh kết hợp với Grok Build, tăng 9 điểm so với Grok 4.6), vượt qua GPT-5.6 Sol và xếp thứ tư về khả năng lập trình tự nhiên, chỉ đứng sau Claude Fable 5.1, GPT-6 Astra và Claude Opus 5. Phiên bản này đi kèm mức tiêu thụ token cao hơn, cửa sổ ngữ cảnh 500k, với giá thành giữ nguyên như Grok 4.6.
Grok 4.7 (@SpaceXAI và @elonmusk) hiện đã gia nhập Agent Arena
X: Arena (@arena)Chính chủGrok 4.7 (@SpaceXAI và @elonmusk) hiện đã gia nhập Agent Arena, tác giả mời người dùng bình chọn và gửi các câu lệnh (prompt) có độ khó cao. Theo bài viết gốc, Arena này đánh giá các mô hình dựa trên hàng triệu tác vụ đại lý (agent) thực tế, dài hạn từ người dùng toàn cầu. Mô hình có khả năng truy cập tìm kiếm web, hệ thống tệp và công cụ dòng lệnh để hoàn thành các quy trình công việc phức tạp. Bảng xếp hạng sử dụng phương pháp truy vết nhân quả để đo lường hiệu suất của mô hình so với các mô hình trung bình.
Grok 4.7 ra mắt, tuyên bố thông minh và mạnh mẽ hơn trong khi vẫn giữ nguyên tốc độ và chi phí
X: Michael Truell (@mntruell)Grok 4.7 đã chính thức được phát hành. Phiên bản này được tuyên bố là thông minh và có năng lực vượt trội hơn thế hệ tiền nhiệm, đồng thời duy trì tốc độ và chi phí ở mức tương đương; đây là thông tin từ phía nhà phát hành và chưa được kiểm chứng độc lập.
Mô hình Grok 4.7 của @SpaceXAI đã có mặt trên OpenRouter
X: OpenRouter (@OpenRouter)Chính chủTheo bài đăng, mô hình Grok 4.7 của @SpaceXAI hiện đã khả dụng trên OpenRouter để người dùng trải nghiệm ngay lập tức. Bài viết khẳng định đây là mô hình mạnh mẽ nhất của đội ngũ trong các tác vụ lập trình và xử lý tri thức, có khả năng xử lý các nhiệm vụ khó trong thời gian dài hơn, tự kiểm tra kỹ lưỡng hơn và dẫn đầu về hiệu năng trên giá thành trong bài kiểm tra CursorBench 4.0.
Đơn vị phát hành thông báo mô hình Grok 4.7 đã lên sóng, khẳng định đây là mô hình tốt nhất hiện nay và có thể dùng thử trên Cursor, Grok Build, API cùng nhiều nền tảng khác
X: Eric Zakariasson (@ericzakariasson)Đơn vị phát hành thông báo mô hình Grok 4.7 đã lên sóng và định vị đây là mô hình tốt nhất từ trước đến nay; người dùng có thể dùng thử trên Cursor, Grok Build, API hoặc bất kỳ nơi nào có hỗ trợ Token. Bài viết gốc còn đính kèm ví dụ so sánh việc xây dựng "Age of Empires 2" giữa Grok 4.6 và 4.7. Bài viết gốc không nêu đích danh đơn vị phát hành là xAI.
Grok 4.7 ra mắt, mang lại những cải tiến đáng kể so với Grok 4.6 trong khi giữ nguyên giá và tốc độ
X: SpaceXAI (@SpaceXAI)Chính chủGrok 4.7 ra mắt. Theo báo cáo gốc, phiên bản này có những cải tiến đáng kể trong khi vẫn duy trì mức giá và tốc độ tương đương Grok 4.6. Bài viết gốc không đề cập cụ thể ngày phát hành.
x.ai ra mắt Grok 4.7: Tập trung vào lập trình và tri thức, đồng giá với Grok 4.6, công bố kết quả kiểm chuẩn, các rào cản an toàn mới, cùng thông tin về giá và các kênh phát hành trong hôm nay
Hacker News: AI bài nổi bậtx.ai thông báo phát hành Grok 4.7, định vị là mô hình mạnh nhất của hãng trong lĩnh vực lập trình và tri thức. Mô hình sử dụng nền tảng mới với quy mô lớn hơn Grok 4.6, được huấn luyện tăng cường trong thời gian dài hơn, giúp nâng cao khả năng xử lý tác vụ dài, tự kiểm chứng và quản lý ngữ cảnh dài. Thông báo cho biết mô hình được trang bị hệ thống rào cản an toàn hoàn toàn mới, đạt hiệu suất cao nhất trong các bài kiểm tra từ chối và chống vượt rào (jailbreak). Trên HackerBench v0.3, mô hình chỉ cho phép 3,3% các câu lệnh có rủi ro cao và đứng đầu bảng xếp hạng an toàn sinh học LatchBio (62,4%). Đồng thời, hãng cũng bắt đầu cung cấp quyền truy cập thử nghiệm đỏ (red teaming) theo lời mời cho một số đối tác an ninh mạng. Về kiểm chuẩn, thông báo cho biết mô hình đạt hiệu suất chi phí hàng đầu trên CursorBench 4.0 (46,3%) và đạt 71,0 điểm trên DeepSWE v1.1. Grok 4.7 đã có mặt trên Cursor và Grok Build từ hôm nay, đồng thời có thể sử dụng qua Grok API, các công cụ lập trình bên thứ ba, bộ định tuyến mô hình và các nền tảng đám mây. Giá dịch vụ là 2 USD cho mỗi triệu token đầu vào và 6 USD cho mỗi triệu token đầu ra, ngoài ra còn cung cấp biến thể tốc độ cao với giá và tốc độ đều tăng gấp đôi.
SpaceXAI ra mắt Grok 4.7 – mô hình chuyên biệt cho lập trình và tri thức
xAI: News (Web)Chính chủNgày 21/9/2026, SpaceXAI chính thức phát hành Grok 4.7, khẳng định đây là mô hình mạnh mẽ nhất hiện nay trong lĩnh vực lập trình và xử lý tri thức. Mô hình này sử dụng nền tảng lớn hơn so với Grok 4.6, được tinh chỉnh qua quá trình học tăng cường kéo dài, giúp nâng cao đáng kể khả năng tự kiểm tra. Theo công bố, Grok 4.7 dẫn đầu về hiệu năng trên giá thành trong các bài kiểm tra như CursorBench 4.0 và được tích hợp cơ chế bảo mật hoàn toàn mới. Mô hình đã có sẵn trên Cursor, Grok Build, Grok API và các kênh bên thứ ba ngay trong ngày ra mắt, với mức giá khởi điểm 2 USD cho mỗi triệu token đầu vào và 6 USD cho mỗi triệu token đầu ra. Ngoài ra, hãng còn cung cấp phiên bản tốc độ cao với mức giá gấp đôi.