Elon Musk@elonmusk, xAI
Điểm AI 40/100

Hướng dẫn

Grok 4.6 soán ngôi đầu bảng MedAgentBench, vượt mặt GPT-5.6 Sol trong tác vụ y tế

(giờ Việt Nam)

Nguyên văn trên X

Grok 4.6 takes top spot on this benchmark

Dịch · tóm tắt AI

Mô hình Grok 4.6 của xAI vừa thiết lập kỷ lục mới trên MedAgentBench với tỷ lệ pass@1 đạt 95,9%, chính thức vượt qua GPT-5.6 Sol và cải thiện đáng kể so với phiên bản tiền nhiệm.

GrokxAIAI y tếMedAgentBenchLLM

Bài viết được AI dịch và tổng hợp tự động từ X: Elon Musk (@elonmusk, xAI). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

Grok 4.6 soán ngôi đầu bảng MedAgentBench, vượt mặt GPT-5.6 Sol trong tác vụ y tế | AIHOT.vn