Xiaomi phân tích lỗi lặp lại lệnh gọi công cụ trên MiMo-V2.6 và giới thiệu phương pháp MOPD, giúp giảm chi phí khắc phục xuống chỉ còn 4% so với giải pháp MixRL truyền thống.
Vì sao đáng đọc: Bài viết cung cấp các thí nghiệm quy kết và lộ trình khắc phục hoàn chỉnh, đồng thời công khai so sánh chi phí, giúp độc giả tham khảo phương pháp chẩn đoán hành vi đột biến trong huấn luyện RL.
Bài viết phân tích sự chuyển dịch của cuộc đua AI năm 2026 từ trí thông minh thuần túy sang cân bằng giữa hiệu năng và chi phí. Tác giả đánh giá dòng MiMo-V2.6 vừa ra mắt với bước nhảy vọt về thông minh gấp đôi so với thế hệ trước.
DịchXiaomi vừa trình làng bộ đôi mô hình mã nguồn mở MiMo-V2.6 Pro và Flash. Phiên bản Pro đạt điểm số kỷ lục 46 trên Artificial Analysis, khẳng định năng lực vượt trội ngang hàng với Claude Opus 5 và GPT-5.6 Sol trong các tác vụ Agent.
Vì sao đáng đọc: Tác giả đánh giá mô hình mới của Xiaomi từ góc độ quyền hạn mã nguồn mở, các so sánh chuẩn mực được trích dẫn giúp xác định sự thay đổi khoảng cách giữa mô hình mã nguồn mở và mô hình tiên phong đóng trên Claude Opus 5 và GPT-5.6 Sol.
Xiaomi vừa trình làng dòng MiMo-V2.6, trong đó bản Pro dẫn đầu bảng xếp hạng Artificial Analysis với chi phí cực kỳ cạnh tranh, dù Anthropic cáo buộc mô hình này được huấn luyện bằng dữ liệu chưng cất từ Claude.
Xiaomi vừa công bố mã nguồn mở bộ mô hình MiMo-V2.6, bao gồm các phiên bản Pro và Flash với khả năng đa phương thức mạnh mẽ, vượt qua nhiều đối thủ trong các bài kiểm tra hiệu năng nhờ ứng dụng học tăng cường quy mô lớn.
Xiaomi vừa công bố dòng mô hình MiMo-V2.6 (Pro và Flash) với khả năng đa phương thức toàn diện, đánh dấu bước tiến quan trọng trong việc ứng dụng cơ chế tự cải tiến đệ quy (RSI) vào nghiên cứu khoa học.
Xiaomi chính thức phát hành dòng mô hình đa phương thức MiMo-V2.6 gồm bản Pro và Flash. Trong đó, bản Pro đạt 46 điểm trên bảng xếp hạng AA Intelligence Index v4.3.2.
MiMo-V2.6-Pro: 1.02T-42B active MiMo-V2.6-Flash: 310B-15B active Top open model on Artificial Analys…
DịchXiaomi vừa công bố dòng MiMo-V2.6 với các phiên bản Pro và Flash, tập trung vào khả năng tự cải tiến thông qua học tăng cường (RL) quy mô lớn và hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token.
DịchĐội ngũ Xiaomi đang thực hiện huấn luyện Reinforcement Learning (RL) cho MiMo-V2.6 với quy mô tính toán lên tới 2 tỷ token mỗi bước, nhằm khám phá giới hạn tối đa của mô hình.
This should be the standard for building open-source AI. $1M+ so far.
DịchXiaomi đang đẩy mạnh huấn luyện RL quy mô lớn cho MiMo-V2.6 với hạ tầng tính toán khổng lồ và cơ chế đánh giá đa nhiệm phức tạp. Dự án đã tiêu tốn hơn 1 triệu USD và sẽ sớm công bố chi tiết kỹ thuật trong vài tuần tới.
Chuyên gia Ma Dongxi tiết lộ chi phí huấn luyện MiMo-V2.6 đạt hơn 1,1 triệu USD, với mức giá mỗi triệu token cho bản Pro là 34,3 USD và bản Flash là 8,7 USD. Tổng chi phí dự kiến có thể lên tới 3 triệu USD.