25/09

Thứ Sáu · 1 tin
Clément Delangue (Hugging Face CEO)@ClementDelangue
Mô hìnhĐiểm AI 49/100

Hugging Face ra mắt SmolDataEnvs: 5.000 tác vụ RL giúp huấn luyện mô hình nhỏ

Super happy to release SmolDataEnvs: 5, 000 verifiable RL environment tasks for hill-climbing small m…

DịchHugging Face vừa công bố SmolDataEnvs, bộ dữ liệu gồm 5.000 tác vụ học tăng cường (RL) có thể kiểm chứng, hỗ trợ tối ưu hóa các mô hình AI nhỏ trong lĩnh vực khoa học dữ liệu và lập trình.

21/09

Thứ Hai · 2 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 54/100

FrogNano: Mô hình lập trình 4B đạt 61.5% trên SWE-bench Verified nhờ huấn luyện tổng hợp tác vụ

A 4B coding agent reached 61.5% on SWE-bench Verified without frontier-model distillation by combini…

DịchFrogNano là mô hình AI chuyên biệt cho lập trình với kích thước nhỏ gọn 4 tỷ tham số, gây ấn tượng mạnh khi đạt hiệu suất 61.5% trên bộ kiểm chuẩn SWE-bench Verified thông qua phương pháp huấn luyện tổng hợp tác vụ trực tuyến.

17/09

Thứ Năm · 2 tin
ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 31/100

MiniCPM5-2B hợp tác cùng OpenMed triển khai AI lâm sàng cục bộ

🏥 Bringing local agentic AI to healthcare with MiniCPM5-2B × OpenMed! @OpenMed_AI paired OpenMed w…

DịchMô hình MiniCPM5-2B kết hợp cùng OpenMed để tối ưu hóa quy trình lâm sàng, cho phép AI tự động phân tích kết quả xét nghiệm và tạo báo cáo ngay trên thiết bị mà vẫn đảm bảo bảo mật dữ liệu bệnh nhân.

15/09

Thứ Ba · 1 tin
ModelBest OpenBMB@OpenBMB
NgànhĐiểm AI 39/100

MiniCPM5-2B: Chạy tác nhân AI cục bộ mượt mà trên MacBook Air M2

On-device personal agent, running locally on a MacBook Air M2 (16GB). @PaulGugAI put MiniCPM5-2B beh…

DịchMô hình MiniCPM5-2B hỗ trợ Hermes Agent có thể vận hành cục bộ trên MacBook Air M2 với tốc độ 20-24 tok/s và cửa sổ ngữ cảnh 96k. Đây là giải pháp AI gọn nhẹ, hiệu quả cho các tác vụ cá nhân mà không cần phụ thuộc vào dịch vụ đám mây.

14/09

Thứ Hai · 3 tin
ModelBest OpenBMB@OpenBMB
NgànhĐiểm AI 35/100

MiniCPM5-2B vận hành thị trấn ảo đa tác nhân: Bước tiến mới trong mô hình nhỏ

🏘️ What happens when AI agents get their own goals, memories, and a town to live in? Developer @ai…

DịchNhà phát triển đã xây dựng Whisper Town, một thị trấn ảo với 8 AI có trí nhớ dài hạn, khả năng cộng tác và tự học từ thất bại, vận hành hoàn toàn cục bộ nhờ sự kết hợp giữa MiniCPM5-2B và Qwen 27B.

karminski@karminski3
NgànhĐiểm AI 29/100

Nhìn lại hành trình DeepSeek R1: Từ tư duy chuyên sâu đến bước đột phá của các mô hình nhỏ

DeepSeek R1 đã chứng minh hiệu suất vượt trội khi chưng cất tư duy vào các mô hình nhỏ như Qwen, cho thấy khả năng giải quyết vấn đề tăng vọt theo ngân sách suy luận. Bài viết cũng gợi nhắc sự kiện thú vị khi Ollama đưa các phiên bản chưng cất này đến gần hơn với người dùng cá nhân.

Ethan Mollick@emollick
NgànhĐiểm AI 40/100

Cuộc chiến chủ quyền dữ liệu doanh nghiệp đối mặt bài toán chi phí khi tinh chỉnh mô hình nhỏ

I feel like the data sovereignty movement for firms is going to run headlong into the challenge that…

DịchEthan Mollick cảnh báo rằng việc duy trì các mô hình AI nhỏ tự tinh chỉnh sẽ trở nên đắt đỏ và khó khăn khi các mô hình lớn đa năng ngày càng mạnh mẽ, tạo ra thách thức lớn cho xu hướng chủ quyền dữ liệu doanh nghiệp.

09/09

Thứ Tư · 4 tin
Elvis Saravia@omarsar0
NgànhĐiểm AI 47/100

Cùng sự kiệnMicrosoft ra mắt FrogNano: Mô hình lập trình 4B tham số huấn luyện thuần bằng Reinforcement Learning

Super cool paper from Microsoft. They show that it's possible to build competitive small coding ag…

DịchMicrosoft giới thiệu FrogNano, mô hình lập trình 4B tham số được huấn luyện hoàn toàn bằng học tăng cường (RL) mà không cần chưng cất tri thức từ các mô hình lớn. Phương pháp này chứng minh rằng việc tập trung vào các tác vụ tự tổng hợp phù hợp với khả năng của mô hình giúp tối ưu hiệu suất vượt trội.

Cùng sự kiện, bài đại diện «Microsoft ra mắt FrogNano: Tác nhân AI 4B tham số tự học lập trình qua Reinforcement Learning»
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 59/100

Microsoft ra mắt FrogNano: Tác nhân AI 4B tham số tự học lập trình qua Reinforcement Learning

Banger report from Microsoft. (bookmark it) They show that it's possible to build competitive smal…

DịchMicrosoft giới thiệu FrogNano, mô hình 4B tham số tự học lập trình trên 1.500 môi trường phần mềm bằng Reinforcement Learning mà không cần chưng cất từ mô hình lớn. Điểm đột phá nằm ở quy trình tổng hợp nhiệm vụ trực tuyến giúp tối ưu hóa khả năng học tập của mô hình.

Thêm 1 nguồn khác đưa tinX: Elvis Saravia (@omarsar0, DAIR.AI)
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 68/100

Desert Ant Labs ra mắt 18 mô hình AI chuyên biệt chạy trực tiếp trên thiết bị

Desert Ant Labs vừa công bố 18 mô hình AI nhỏ gọn cho thiết bị di động, hỗ trợ xử lý âm thanh, hình ảnh và văn bản thông qua bộ SDK thống nhất trên Swift, Kotlin và JavaScript.

Thêm 1 nguồn khác đưa tinX: Clément Delangue (Hugging Face CEO) (@ClementDelangue)
ModelBest OpenBMB@OpenBMB
NgànhĐiểm AI 36/100

MiniCPM5-2B: Tăng tốc 34% hiệu suất cho tác vụ AI cục bộ

Same Q4_K_M quant, same tasks, same success rate, MiniCPM5-2B can get tasks done quicker. This makes…

DịchMô hình MiniCPM5-2B của OpenBMB vượt trội hơn Qwen3.5-4B với tốc độ xử lý nhanh hơn 34% trong các tác vụ thực tế, mở ra tiềm năng lớn cho các ứng dụng AI chạy trực tiếp trên thiết bị.

08/09

Thứ Ba · 2 tin
JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnMặt Bích AI ra mắt MiniCPM5-2B: 'Siêu nhỏ' nhưng mạnh mẽ, đưa khả năng Agent lên thiết bị di động

Mặt Bích AI vừa mã nguồn mở MiniCPM5-2B, mô hình 2 tỷ tham số sở hữu khả năng thực thi tác vụ phức tạp (Agent) ngay trên thiết bị, vượt mặt nhiều đối thủ lớn hơn về hiệu suất và khả năng suy luận.


Vì sao đáng đọc: Tin tức quan trọng về bước tiến của mô hình nhỏ (SLM) có khả năng Agent. Việc công khai cả quy trình huấn luyện và dữ liệu là điểm cộng lớn cho cộng đồng phát triển.

07/09

Thứ Hai · 2 tin
ModelBest OpenBMB@OpenBMB
Mô hìnhĐiểm AI 58/100

MiniCPM5-2B của OpenBMB: Mô hình AI dưới 4B tham số mạnh nhất hiện nay

🚀 Meet MiniCPM5-2B, a 2B-parameter language model bringing high intelligence density to the edge, n…

DịchOpenBMB vừa ra mắt MiniCPM5-2B, mô hình ngôn ngữ nhỏ gọn nhưng dẫn đầu bảng xếp hạng Artificial Analysis cho các model dưới 4B tham số, đồng thời đạt điểm số ấn tượng 20 trong chỉ số Agentic Index.

Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 55/100

MiniCPM5-2B dẫn đầu bảng xếp hạng trí tuệ cho các mô hình AI dưới 4 tỷ tham số

OpenBMB's MiniCPM5-2B scores 15 on the Artificial Analysis Intelligence Index v4.2, the highest of a…

DịchArtificial Analysis đánh giá MiniCPM5-2B đạt 15 điểm trên Intelligence Index v4.2, trở thành mô hình mã nguồn mở dưới 4B tham số thông minh nhất hiện nay, chỉ xếp sau Ling 3.0 Tiny.

Thêm 3 nguồn khác đưa tinX: ModelBest OpenBMB (@OpenBMB)IT HomeWeChat: ModelBest (MiniCPM)

04/09

Thứ Sáu · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 46/100

Compile by Training: Chuyển đổi đặc tả ngôn ngữ tự nhiên thành hàm thần kinh cục bộ

Nghiên cứu giới thiệu phương pháp 'Compile by Training', cho phép biên dịch các yêu cầu ngôn ngữ tự nhiên thành các adapter nhỏ gọn, có thể tái sử dụng, lưu trữ và kết hợp như phần mềm truyền thống mà không cần phụ thuộc vào mô hình lớn khi vận hành.

01/09

Thứ Ba · 2 tin
Elvis Saravia@omarsar0
Hướng dẫnĐiểm AI 40/100

Kỷ nguyên mới của trí tuệ nhân tạo tùy chỉnh: Khi mô hình nhỏ đánh bại gã khổng lồ

CEO Shopify chia sẻ về việc mô hình 0.8B được tinh chỉnh chuyên biệt đã vượt qua các siêu mô hình lớn nhờ cơ chế tự cải tiến liên tục, mở ra xu hướng doanh nghiệp tự xây dựng hệ sinh thái AI riêng để tạo lợi thế cạnh tranh.

Ant Group inclusionAI: HuggingFace mô hình mới
Mô hìnhĐiểm AI 44/100

Cùng sự kiệnAnt Group ra mắt Ling-3.0-tiny-singprobe: Công cụ giám sát an toàn AI siêu nhẹ

Ant Group vừa phát hành SingProbe trên Hugging Face, một mô hình giám sát an toàn chỉ với 3,22 triệu tham số. Công cụ này giúp phát hiện rủi ro về ý định, nội dung độc hại và ảo tưởng của AI theo thời gian thực với chi phí vận hành cực thấp.

Cùng sự kiện, bài đại diện «Ant Group ra mắt Ling-3.0-flash-singprobe: Công cụ giám sát an toàn AI siêu nhẹ»

31/08

Thứ Hai · 1 tin

28/08

Thứ Sáu · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 65/100

Kỷ nguyên mô hình nhỏ: Cách gpt-5.6-luna thay đổi cuộc chơi chi phí AI

Các mô hình nhỏ như gpt-5.6-luna đang tạo ra bước ngoặt về tốc độ và chi phí, cho phép xử lý khối lượng công việc lớn với giá cực rẻ. Đây là tín hiệu cho thấy các ứng dụng AI tiêu dùng và doanh nghiệp sẽ bùng nổ nhờ hiệu suất tối ưu.

24/08

Thứ Hai · 2 tin
Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 59/100

Artificial Analysis hợp tác cùng Liquid AI đánh giá hiệu năng mô hình nhỏ trên smartphone

Which model should you run on the iPhone 17 Pro? Announcing our new intelligence and inference test…

DịchArtificial Analysis phối hợp với Liquid AI thực hiện bài kiểm tra độc lập về hiệu năng suy luận và trí thông minh của các mô hình nhỏ (4-bit trở xuống) trên iPhone 17 Pro và Galaxy S26 Ultra.

Thêm 1 nguồn khác đưa tinIT Home
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnDaedalus-150M: Mô hình ngôn ngữ lai Convolution-Attention tối ưu cho CPU

Daedalus-150M là mô hình ngôn ngữ nhỏ được thiết kế chuyên biệt cho CPU, sử dụng kiến trúc lai giúp giảm đáng kể bộ nhớ cache mà vẫn vượt trội hơn các mô hình cùng kích thước dù được huấn luyện với ít dữ liệu hơn.


Vì sao đáng đọc: Cách tiếp cận thiết kế kiến trúc từ mục tiêu phần cứng (CPU) thay vì nén mô hình lớn là hướng đi rất thực tế và hiệu quả cho ứng dụng AI trên thiết bị cá nhân.

21/08

Thứ Sáu · 1 tin
ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 29/100

Ứng dụng tìm đồ thất lạc thông minh nhờ sức mạnh từ mô hình MiniCPM

What can you build with small multimodal models beyond demos? Lost & Found Desk built by developer …

DịchNhà phát triển JacobLinCool đã tạo ra ứng dụng Lost & Found Desk, sử dụng MiniCPM-V 4.6 để nhận diện hình ảnh và MiniCPM-1B để xử lý ngôn ngữ, chứng minh hiệu quả thực tế của các mô hình AI nhỏ gọn.

19/08

Thứ Tư · 1 tin
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 39/100

Synthefy ra mắt Nori: Mô hình 30M tham số thách thức đối thủ 1.6B

Tabular data is so ready for disruption. Structured/tabular data is now getting its own foundation-…

DịchSynthefy giới thiệu Nori, nền tảng mô hình nền tảng cho dữ liệu số có cấu trúc. Với chỉ 30 triệu tham số, Nori-30M đạt hiệu suất tương đương mô hình TabFM 1.6B của Google trong các bài kiểm tra hồi quy, đồng thời công bố gọi vốn thành công 6,5 triệu USD.

17/08

Thứ Hai · 1 tin
ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 36/100

MiniCPM5-1B: Mô hình AI siêu nhẹ giúp phân tích sức khỏe đất nông nghiệp

🌱 A tiny model helping plants tell the story of soil. Developer @RightSideOfAI built AUGURY, an op…

DịchDự án mã nguồn mở AUGURY sử dụng MiniCPM5-1B để phân tích hình ảnh cỏ dại, từ đó đưa ra đánh giá về sức khỏe đất. Với dung lượng chỉ 660MB, mô hình này cho phép chạy ngoại tuyến trên điện thoại mà không bị ảo tưởng thông tin.

15/08

Thứ Bảy · 1 tin
Qwen@Alibaba_Qwen
Hướng dẫnĐiểm AI 41/100

Qwen dẫn đầu xu hướng chạy AI cục bộ, mô hình nhỏ chiếm ưu thế thực tế

Small models, big real-world impact. Proud to see Qwen leading local inference in the State of Open…

DịchBáo cáo từ HuggingFace cho thấy Qwen đang dẫn đầu về khả năng suy luận cục bộ. Dù các mô hình lớn liên tục ra đời, các mô hình nhỏ vẫn là lựa chọn chủ đạo cho ứng dụng thực tế, cùng với sự trỗi dậy mạnh mẽ của các AI Agent.

14/08

Thứ Sáu · 2 tin
ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 48/100

Mặt Bích AI ra mắt nhân vật 3D 'Karate Wiener' vận hành bởi mô hình VoxCPM-0.5B

🥋 Karate Wiener is an interactive 3D character experience, featuring a hotdog sensei who teaches ka…

DịchOpenBMB giới thiệu Karate Wiener, nhân vật 3D tương tác hỗ trợ trò chuyện giọng nói và tạo hành động, được vận hành bởi mô hình siêu nhẹ VoxCPM-0.5B. Dự án này chứng minh tiềm năng ứng dụng của các mô hình AI nhỏ gọn trong lĩnh vực giải trí sáng tạo.

Ant Ling@AntLingAGI
Sản phẩmĐiểm AI 39/100

Ant Group ra mắt Ling-3.0-tiny: Mô hình AI tự học trên một máy chủ duy nhất

7.9B total. 1.3B active. One DGX Spark. No cluster. Ling-3.0-tiny × ASystem AReno closes the Agentic…

DịchVới 7.9B tham số, Ling-3.0-tiny kết hợp cùng ASystem AReno cho phép thực hiện quy trình học tăng cường (RL) khép kín ngay trên một máy chủ DGX Spark, giúp tối ưu hóa việc lặp lại và huấn luyện mô hình mà không cần cụm máy chủ phức tạp.

13/08

Thứ Năm · 2 tin
ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 38/100

MiniCPM5-1B: Khi các AI Agent 'đấu trí' trên sàn giao dịch chứng khoán ảo

🐺 A tiny model powering an autonomous AI trading floor. Developer @ashdebugs built Wall Street of …

DịchNhà phát triển đã sử dụng mô hình MiniCPM5-1B để tạo ra một sàn giao dịch với 4 AI Agent có tính cách khác biệt, tự đưa ra quyết định và cạnh tranh trong môi trường mô phỏng mà không cần dùng đến API đám mây.

ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 32/100

Thousand-Token Theater: Sân khấu kịch ứng tác từ mô hình AI 1B siêu nhỏ

🎭 What happens when a 1B model has only 1, 000 tokens of memory? Meet Thousand-Token Theater, an AI…

DịchNhà phát triển @jhahimanshu653 đã tạo ra Thousand-Token Theater, sử dụng mô hình MiniCPM5-1B và VoxCPM2 để trình diễn kịch ứng tác thời gian thực với giới hạn bộ nhớ chỉ 1.000 token.

12/08

Thứ Tư · 2 tin
Tổng 34 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (47 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Mô hình nhỏ” | AIHOT.vn