QbitAI
85

Tin ngành

Trần Đại Niên tái xuất, chính thức gia nhập cuộc đua mô hình ngôn ngữ lớn

(giờ Việt Nam)

Tóm tắt AI

Cựu lãnh đạo Shanda, Trần Đại Niên, vừa đánh dấu sự trở lại với dự án AI mới, đạt hiệu suất tiệm cận mô hình flagship nghìn tỷ tham số của DeepSeek.

Bản dịch AI

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

Trần Đại Niên tái xuất, gia nhập cuộc chơi mô hình ngôn ngữ lớn (LLM).

03-09-2026 18:13:24 Nguồn: QbitAI

Màn chào sân bám đuổi sát nút "siêu phẩm" nghìn tỷ tham số của DeepSeek.

Lộ Vũ đưa tin từ QbitAI.

QbitAI | Kênh thông tin chính thức QbitAI.

Không thể tin được! Nhóm dẫn đầu các mô hình ngôn ngữ lớn nội địa vừa tạo ra một cú sốc bất ngờ.

Một công ty mới, với mô hình đầu tay chỉ có 27B tham số, đã xuất sắc giành vị trí thứ hai chung cuộc trong bài kiểm tra chuyên biệt MCP của Viện Công nghệ Thông tin và Truyền thông Trung Quốc (CAICT).

Đứng ngay phía trên họ là "vũ khí hạng nặng" mà Lương Văn Phong đã ấp ủ gần một năm qua — DeepSeek-V4-Pro với quy mô lên tới 1,6 nghìn tỷ tham số.

Khoảng cách giữa hai bên chỉ vỏn vẹn 1,3 điểm phần trăm.

"Chú ngựa ô" này chính là StartLux-V1.0-27B-Preview, đến từ StartLux (Nguyên Điểm Tinh Huy).

Nghe có vẻ lạ lẫm phải không? Đừng vội, người sáng lập kiêm CEO của nó lại là một gương mặt vô cùng quen thuộc: Trần Đại Niên.

Được mệnh danh là "bố già" lập trình viên thế hệ đầu thời kỳ Internet, với bảng thành tích đáng nể:

Đồng sáng lập Shanda Network, người đứng đầu LianShang Network, một trong những lập trình viên đầu tiên tại Trung Quốc giới thiệu khái niệm "phần mềm chia sẻ" (shareware)...

Sau mười năm lui về ở ẩn, lần này ông đặt cược vào các mô hình chạy cục bộ (local model).

Điều này khiến chúng ta phải nhắc đến lần xuất hiện hiếm hoi gần đây của Trần Đại Niên.

Tại buổi họp mặt bạn cũ nhân kỷ niệm 18 năm thành lập Viện Sáng tạo Shanda, ông đã công khai tuyên bố về "tám điểm phi đồng thuận trong kỷ nguyên AI", trong đó có bốn điểm nhấn mạnh vào mô hình cục bộ.

Mô hình cục bộ sẽ hoàn toàn phá vỡ thị trường điện toán đám mây, trong vòng 3 năm sẽ bắt kịp Claude và chiếm lĩnh 80% thị phần. Cuộc chơi chạy đua tham số mô hình sắp lỗi thời rồi...

StartLux chính là minh chứng rõ nét nhất cho triết lý của ông.

Hoạt động kinh doanh của công ty không đi theo xu hướng chung của ngành mà tập trung vào thương mại hóa các mô hình cục bộ nhỏ gọn nhưng tinh tế; đây cũng là công ty mô hình cục bộ đúng nghĩa đầu tiên trên thế giới.

Và với tư cách là bảng thành tích đầu tiên hướng tới thị trường, StartLux-V1.0-27B-Preview không phụ thuộc vào đám mây mà có thể chạy trực tiếp trên các máy tính cá nhân phổ thông.

Nói cách khác, dù nhỏ hơn gần 60 lần, nhưng khả năng làm Agent (tác nhân AI) của mô hình cục bộ này lại có thể sánh ngang với các "siêu phẩm" đám mây nghìn tỷ tham số.

Dựa vào đâu mà làm được như vậy?

27B đối đầu 1.6T, mô hình nhỏ tạo ra kết quả lớn.

Trước khi vén màn bí mật, hãy cùng xem đối thủ lần này là ai.

Người ta thường nói, chẳng ai nhớ đến người về nhì, trừ khi người về nhất là DeepSeek.

Hơn nữa, khoảng cách chỉ là trong gang tấc, rất đáng để bàn luận.

Kết quả đến từ một tổ chức uy tín: bài kiểm tra chuẩn mực MCP dành cho các mô hình AI đáng tin cậy của CAICT, tập trung vào sáu loại tác vụ trong các kịch bản ứng dụng thực tế:

Điều hướng vị trí, tìm kiếm web, tự động hóa trình duyệt, phân tích tài chính, quản lý kho mã nguồn, thiết kế 3D.

Cộng thêm một đánh giá tổng hợp, tập trung kiểm tra khả năng phối hợp đa công cụ của Agent, thực thi các tác vụ phức tạp và tương tác trong môi trường thực tế.

Nói một cách đơn giản, MCP-Universe không đánh giá mô hình trả lời hay hay dở, mà xem xét liệu công việc đó có thực sự được hoàn thành hay không. Đây cũng chính là điểm cốt lõi nhất để đánh giá một Agent tốt hay xấu.

Kết quả cho thấy, StartLux-V1.0-27B-Preview đạt điểm tổng hợp 39,25%, xếp thứ hai.

Vượt qua DeepSeek-V4-Flash-0731 với 284B tham số và Step-3.7-Flash với 198B tham số, chỉ đứng sau DeepSeek-V4-Pro 1,3 điểm phần trăm.

Cùng quy mô 27B tham số, StartLux cũng cao hơn Qwen 3.6 tới 5,34 điểm phần trăm.

Kết quả từng hạng mục cũng rất ấn tượng: điều hướng vị trí, phân tích tài chính và tự động hóa trình duyệt đều đứng vị trí thứ nhất, các hạng mục chi tiết khác cũng đều nằm trong top đầu.

Trần Đại NiênAIMô hình lớnDeepSeekCông nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.