Fireworks Research giới thiệu mô hình chuyên biệt Ember-1, được huấn luyện dựa trên Kimi K3, giúp duy trì chất lượng đầu ra tương đương trong khi giảm tới 40% lượng token tiêu thụ.
OpenRouter làm rõ Kimi K3 là mô hình mở trọng số (open weights) chứ không phải mã nguồn mở hoàn toàn, đồng thời hướng dẫn cách truy cập model moonshotai/Kimi-K3 trên Hugging Face theo giấy phép riêng của Moonshot AI.
Vì sao đáng đọc: Bài viết phân tích chi tiết từng điều khoản trong giấy phép sử dụng của Kimi K3 cùng ngưỡng quy mô hóa, đồng thời cung cấp các tham số gọi API qua OpenRouter và bảng giá của từng đơn vị, giúp độc giả quyết định nên tự triển khai hay sử dụng API.
ALERT ALERT ALERT 🚨 🚨 🚨 VLLM MAINTAINERS HAVE JUST SHOWN THAT TPUv7 CAN GET 700 tok/s/user, 56% …
DịchCác nhà phát triển vLLM công bố TPUv7 đạt tốc độ 700 tok/s/user trên mô hình Kimi K3 sau khi tối ưu megakernel, vượt trội 56% so với hệ thống GB200 NVL72. Kết quả này cho thấy tiềm năng lớn từ việc tối ưu hóa phần mềm cho hạ tầng TPU.
Báo cáo gửi Quốc hội Mỹ chỉ ra rằng các mô hình như GLM-5.3 và Kimi K3 đang giúp Trung Quốc dẫn trước Mỹ từ 2-6 tháng trong lĩnh vực mô hình mở, với tổng lượt tải xuống gấp đôi so với phía Mỹ.
Tại AICC2026, Inspur giới thiệu siêu máy chủ MetaBrain SD200 Ultra với 128 chip AI nội địa, cho phép vận hành mô hình Kimi K3 2,8 nghìn tỷ tham số với độ trễ ấn tượng dưới 5,85ms/token.
Moonshot's Kimi K3 is now available on Amazon Bedrock. Its license requires a paid agreement when a …
DịchMô hình Kimi K3 của Moonshot AI đã chính thức có mặt trên Amazon Bedrock với cam kết bảo mật dữ liệu nghiêm ngặt: không chia sẻ dữ liệu khách hàng để huấn luyện và không lưu trữ yêu cầu suy luận.
Tại sự kiện AICC2026, Inspur giới thiệu siêu máy chủ AI SD200 Ultra, cho phép vận hành mô hình Kimi K3 với 2.8 nghìn tỷ tham số. Thiết bị đạt độ trễ Token chỉ 5.85ms, nhanh gấp 5 lần mức trung bình của ngành.
Amazon Bedrock vừa bổ sung mô hình Kimi K3 với 2,8 nghìn tỷ tham số, hỗ trợ cửa sổ ngữ cảnh 1 triệu token và tính năng bộ nhớ đệm gợi ý giúp tối ưu chi phí và độ trễ cho lập trình viên.
"American companies such as Modal, Fireworks, and Baseten will be able to serve Kimi K3, at one-tent…
DịchEmad Mostaque cho biết các công ty Mỹ đang tận dụng chip Nvidia và AMD thế hệ mới để tối ưu chi phí vận hành Kimi K3 xuống mức cực thấp, đồng thời dự báo chi phí có thể giảm thêm 10-100 lần khi phần cứng thế hệ tiếp theo như Nvidia Rubin ra mắt.
My model + harness stack these days: 1. Kimi K3 is the best OSS coding model. GLM-5.3 is next. 2. D…
DịchTác giả chia sẻ bộ công cụ AI tối ưu cho lập trình, trong đó Kimi K3 và GLM-5.3 dẫn đầu về khả năng code, DeepSeek V4.1 Flash là lựa chọn tiết kiệm cho tác vụ đơn giản, còn Astra dành cho các bài toán phức tạp.
We're bringing Databricks Unity Gateway to developers on Neon (@neondatabase), and it's the fastest …
DịchDatabricks đã tích hợp Unity Gateway vào nền tảng Neon, mang đến giải pháp truy cập AI tối ưu và tốc độ cao cho các nhà phát triển đang sử dụng mô hình Kimi K3.
AMD ALERT🚨🚨: On Kimi K3 2.8T, AMD has even better profit margins per gigawatt compared to B300, GB…
DịchDữ liệu từ AgentX cho thấy chip Mi355X của AMD đạt biên lợi nhuận 53,6%, vượt trội so với 44,3% của GB200 NVL72 nhờ tối ưu hóa TCO và hiệu năng vượt trội trên mô hình 2.8T.
It's been 23 days since I last opened Claude Code. It used to be one of my favorite products, but I…
DịchSau 23 ngày trải nghiệm, người dùng chuyển từ Claude Code sang Codex vì khả năng tương thích với mô hình nguồn mở tốt hơn. Trong đó, Kimi K3 được đánh giá là mô hình vượt trội nhất hiện nay cho các tác vụ lập trình.
Cognition vừa giới thiệu SWE-2, mô hình lập trình được huấn luyện từ Kimi K3, đạt hiệu suất ngang ngửa Fable 5.1 trên FrontierCode 1.1 nhưng tiết kiệm tới 64% chi phí vận hành.
Nhờ sự thành công của mô hình Kimi K3, Moonshot AI dự kiến đạt doanh thu hàng năm 2 tỷ USD vào cuối năm nay. Công ty hiện đang gọi vốn với định giá 50 tỷ USD và cân nhắc kế hoạch IPO tại Hồng Kông.
Dự án ARGODRIVE Deltafin đã tối ưu hóa việc chạy mô hình Kimi K3 (2.8T) nguyên bản trên MacBook Pro M5 Max, đạt tốc độ 1 token/giây bằng cách truyền tải dữ liệu trực tiếp từ 4 ổ SSD, nhanh gấp 3.5 lần so với các phương pháp trước đây.
Day 1 impressions of Fable 5.1: - talks much more like a normal human now, less Claudish. - web sea…
DịchYuchen Jin đánh giá Fable 5.1 có phong cách giao tiếp tự nhiên hơn, dù khả năng tìm kiếm vẫn thua kém GPT. Đồng thời, ông cho biết Kimi K3 hiện là lựa chọn hàng đầu cho công việc thực tế nhờ hiệu suất vượt mong đợi.
Moonshot AI đang thương thảo với Microsoft, Amazon và Google để chia sẻ tới 30% doanh thu từ việc triển khai mô hình Kimi K3 trên hạ tầng đám mây của họ, đánh dấu bước tiến lớn của AI Trung Quốc tại thị trường Mỹ.
OpenAI-backed legal AI firm Harvey unveiled Tenet, its first in-house model, built on China's open-w…
DịchCông ty luật AI Harvey vừa giới thiệu Tenet, mô hình tự phát triển đầu tiên của họ dựa trên Kimi K3, được huấn luyện trong hai tháng với 150 chip Nvidia B300.
Moonshot AI đang thảo luận chia sẻ 30% doanh thu với các ông lớn công nghệ Mỹ để triển khai mô hình Kimi K3 trên hạ tầng của họ. Đây là bước đi chiến lược quan trọng nhằm mở rộng quy mô toàn cầu cho AI Trung Quốc.
Theo phân tích từ BOCOM International, Kimi K3 của Moonshot AI với 2,8 nghìn tỷ tham số và cửa sổ ngữ cảnh 1 triệu token đang thiết lập chuẩn mực mới về hiệu suất, mang lại khả năng xử lý mạnh mẽ với chi phí tối ưu hơn hẳn các mô hình đóng hiện nay.
Vì sao đáng đọc: Tin tức quan trọng về sự trỗi dậy của mô hình mã nguồn mở có quy mô khổng lồ, tác động trực tiếp đến cán cân chi phí và hiệu năng trong ngành AI.
Harvey vừa giới thiệu Tenet, mô hình hậu huấn luyện tối ưu hóa cho các tác vụ pháp lý phức tạp dựa trên nền tảng Kimi K3, giúp cải thiện đáng kể hiệu suất xử lý hợp đồng và tài liệu chuyên ngành.
This is just the beginning of what's coming. Not paid to say this, but I think Harvey provides a gli…
DịchHarvey vừa giới thiệu Tenet, mô hình AI chuyên dụng cho pháp lý được huấn luyện trên nền tảng Kimi K3. Tenet đạt kết quả ấn tượng trong các bài kiểm tra LAB, thiết lập tiêu chuẩn mới trong ngành với chi phí suy luận chỉ bằng 1/4 so với các mô hình nền tảng phổ biến.
Các mô hình như Kimi K3 và GLM-5.3 đang dần san bằng khoảng cách với AI Mỹ. Phương Tây hiện chỉ còn duy trì ưu thế trong các bài kiểm tra tư duy trừu tượng, độ tin cậy thực tế và an ninh mạng.
Kimi K3 tạo bước ngoặt lớn khi sử dụng hệ thống 18 Agent tự chủ nghiên cứu thông qua cơ chế Harness, giúp hiệu suất tiệm cận với mô hình Opus 5 đình đám.
Vì sao đáng đọc: Tin tức quan trọng về bước tiến đột phá của mô hình nội địa Trung Quốc, ứng dụng công nghệ đa Agent vào nghiên cứu khoa học, có tác động lớn đến thị trường AI.
Tổng 27 tin, không còn tin nào nữa
40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (45 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả