QbitAI
92

Mô hình

Kimi K3 và Unlimited OCR chiếm lĩnh top 2 toàn cầu: Mô hình mã nguồn mở Trung Quốc gây bão quốc tế

(giờ Việt Nam)

Tóm tắt AI

Các mô hình mã nguồn mở từ Trung Quốc như Kimi K3 và Unlimited OCR đang khẳng định vị thế vượt trội khi chiếm lĩnh hai vị trí dẫn đầu trên bảng xếp hạng toàn cầu, tạo nên làn sóng chú ý mạnh mẽ trong cộng đồng AI quốc tế.

Bản dịch AI

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

28-07-2026 16:17:05 Nguồn: QbitAI

Các mô hình AI mã nguồn mở của Trung Quốc đang liên tục thu hút sự chú ý của các nhà phát triển toàn cầu, với những thành tựu đổi mới sáng tạo đang xuất hiện ngày càng nhiều. Tối ngày 27 tháng 7, Moonshot AI đã chính thức công bố mã nguồn mở cho trọng số mô hình hoàn chỉnh của Kimi K3. Ngay lập tức, mô hình này đã leo lên vị trí số 1 trên bảng xếp hạng xu hướng tổng thể của cộng đồng AI mã nguồn mở quốc tế Hugging Face. Theo sát phía sau là Unlimited OCR của Baidu – mô hình đã giữ vị trí dẫn đầu trong nhiều ngày. Cả hai đã chiếm lĩnh hai vị trí đầu bảng trên Hugging Face, được ví như "cặp song sinh mã nguồn mở" của các mô hình AI Trung Quốc.

Việc một mô hình đứng đầu bảng xếp hạng không phải là điều hiếm gặp, nhưng Kimi K3 và Unlimited OCR đã tạo ra hai hiện tượng bùng nổ trong thời gian cực ngắn: Sau khi ra mắt, Kimi K3 đã nhanh chóng chiếm lĩnh vị trí số 1 trên bảng xếp hạng xu hướng Hugging Face chỉ trong vài chục phút, thiết lập kỷ lục tăng trưởng mới cho nền tảng này. Unlimited OCR thậm chí còn hiếm thấy hơn khi đạt hơn 10.000 lượt sao (Star) trên GitHub chỉ trong 5 ngày, ngay khi ra mắt đã đứng đầu bảng xếp hạng GitHub Daily Trending tổng thể và bảng Python, đồng thời dẫn đầu bảng xếp hạng xu hướng mô hình tổng thể và mô hình đa phương thức toàn cầu trên HuggingFace, đạt thành tích đứng đầu cả 4 bảng xếp hạng của GitHub và HuggingFace. Một tháng sau khi ra mắt, độ nóng của Unlimited OCR lại tiếp tục tăng cao, được Yann LeCun – nhà khoa học AI và người đạt giải Turing – chia sẻ lại, giúp mô hình này quay trở lại vị trí số 1 trên bảng xếp hạng xu hướng mô hình toàn cầu của Hugging Face. Tính đến thời điểm hiện tại, Unlimited OCR đã vượt mốc 19.700 lượt sao trên GitHub và đạt 2,65 triệu lượt tải xuống trên HuggingFace.

Việc Unlimited OCR nhận được sự quan tâm liên tục từ các nhà phát triển không chỉ nhờ hiệu năng vượt trội, mà quan trọng hơn là nó đã thúc đẩy công nghệ phân tích tài liệu dài tiến thêm một bước then chốt. Trước đây, khi các mô hình OCR đối mặt với các tài liệu dài như sách, luận văn hay báo cáo, chúng thường phải sử dụng phương pháp kỹ thuật "phân tích từng trang + ghép nối kết quả". Khi nội dung đầu ra ngày càng tăng, KV Cache trong giai đoạn giải mã liên tục phình to, dẫn đến tốc độ suy luận và chi phí bộ nhớ đồ họa (VRAM) cũng tăng theo.

Để giải quyết điểm nghẽn này của ngành, Baidu đã đề xuất cơ chế Reference Sliding Window Attention (R-SWA), học hỏi từ cách con người đọc và chép lại các tài liệu dài – luôn duy trì sự tập trung vào nội dung tài liệu gốc, đồng thời chỉ giữ lại đoạn nội dung vừa tạo gần nhất làm "bộ nhớ làm việc", thay vì tích lũy vô hạn toàn bộ thông tin lịch sử. Dựa trên thiết kế này, mô hình có thể hoàn thành việc phân tích tài liệu dài hàng chục trang trong một lần suy luận tiến (forward inference), đạt được đầu ra liền mạch từ trang đầu đến trang cuối, đồng thời kiểm soát KV Cache trong giai đoạn giải mã ở quy mô cố định, giúp chi phí tính toán và mức tiêu thụ VRAM không tăng theo độ dài của đầu ra.

Các chuyên gia trong ngành cho biết, bước đột phá này không chỉ giúp việc phân tích OCR nhanh hơn, chính xác hơn mà quan trọng hơn là cung cấp tư duy mới cho việc suy luận dài hạn và quản lý bộ nhớ của các mô hình lớn. So với việc phụ thuộc vào việc mở rộng liên tục cửa sổ ngữ cảnh để nâng cao năng lực, sự đổi mới này đã khám phá một con đường mới nhằm thực hiện các tác vụ dài hạn bằng cơ chế chú ý (attention mechanism) hiệu quả hơn.

Chính vì giải quyết được những vấn đề thực tế mà các nhà phát triển phải đối mặt từ lâu, độ nóng của Unlimited OCR không hề giảm sút theo thời gian mà tiếp tục bùng nổ trong cộng đồng nhà phát triển nước ngoài, quay trở lại vị trí số 1 trên bảng xếp hạng xu hướng mô hình toàn cầu của Hugging Face sau một tháng.

Trong cộng đồng mã nguồn mở, việc một dự án lọt vào bảng xếp hạng xu hướng khi mới ra mắt không phải là hiếm, nhưng sau khi độ nóng giảm xuống, việc quay trở lại bảng xếp hạng chỉ dựa vào sự sử dụng liên tục và truyền miệng của các nhà phát triển là điều không phổ biến. Trước đó, DeepSeek-R1 từng nhiều lần lọt vào bảng xếp hạng tại các thời điểm như ra mắt mô hình, mở API; trong khi Unlimited OCR chỉ dựa vào việc các nhà phát triển toàn cầu liên tục tải xuống, triển khai, sử dụng và giới thiệu, đã quay lại đứng đầu bảng xếp hạng xu hướng mô hình toàn cầu của Hugging Face sau một tháng. Điều này cho thấy tầm ảnh hưởng của Unlimited OCR đã mở rộng từ sức nóng khi ra mắt sang việc được các nhà phát triển áp dụng bền vững và lan tỏa trong cộng đồng, đồng thời phản ánh rằng mã nguồn mở AI của Trung Quốc đang chuyển mình từ "ra mắt là được chú ý" sang "được áp dụng liên tục", củng cố tầm ảnh hưởng quốc tế thành tầm ảnh hưởng trong hệ sinh thái nhà phát triển toàn cầu.

Được biết, Baidu đã kiên trì và thực hiện triết lý mã nguồn mở từ lâu. Không chỉ dừng lại ở các mô hình, trước đó hãng đã mở nguồn các nền tảng hạ tầng AI như khung học sâu PaddlePaddle, nền tảng lái xe tự động Apollo, và quyên góp các dự án kỹ thuật phổ quát trưởng thành như ECharts, bRPC, Doris, HugeGraph cho quỹ mã nguồn mở quốc tế Apache, tích cực hòa nhập vào hệ thống mã nguồn mở toàn cầu.

Những năm gần đây, các doanh nghiệp trí tuệ nhân tạo Trung Quốc liên tục đạt được những đột phá nguyên bản xung quanh các hướng then chốt như suy luận, đa phương thức, văn bản dài, trí tuệ tài liệu, dần hình thành mô hình phát triển nở rộ nhiều điểm và đổi mới phối hợp. Từ DeepSeek, Kimi cho đến Unlimited OCR của Baidu, những gì AI Trung Quốc đóng góp không chỉ là các mô hình có tính cạnh tranh quốc tế, mà còn là các công nghệ nguyên bản, hệ sinh thái mã nguồn mở và các mô hình đổi mới liên tục. Trí tuệ nhân tạo Trung Quốc đang chuyển mình từ việc tham gia cạnh tranh toàn cầu sang đóng góp cho đổi mới toàn cầu, truyền thêm trí tuệ và giải pháp của Trung Quốc vào việc nuôi dưỡng phát triển lực lượng sản xuất chất lượng mới cũng như thúc đẩy tiến bộ công nghệ trí tuệ nhân tạo toàn cầu.

Địa chỉ mã nguồn mở Unlimited OCR:

GitHub: https://github.com/baidu/Unlimited-OCR

HuggingFace: https://huggingface.co/baidu/Unlimited-OCR

Bài viết này do Baidu cung cấp, QbitAI đã được cấp phép đăng tải lại, quan điểm thuộc về tác giả gốc.

Bản quyền thuộc về đơn vị sở hữu, không được phép sao chép và sử dụng dưới mọi hình thức khi chưa được cho phép, những trường hợp vi phạm sẽ bị xử lý theo quy định.

AI Trung QuốcKimi K3Mã nguồn mởOCRBảng xếp hạng AI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.