NVIDIA ra mắt Nemotron 3.5 Lightning
Tổng quan sự kiện
Toàn cảnh do AI tổng thuật
Vào ngày 11 tháng 8 năm 2026, NVIDIA đã phát hành Nemotron 3.5 Lightning, một mô hình hỗn hợp chuyên gia (MoE) mã nguồn mở với tổng số tham số khoảng 30 tỷ (31.6B), trong đó 3.6B tham số được kích hoạt, sử dụng giấy phép thương mại OpenMDW-1.1. Mô hình này được thiết kế chuyên biệt cho các tác vụ AI tác tử (agent) cục bộ, có thể chạy trên các thiết bị như RTX PC, DGX Spark và Jetson, đồng thời hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token.
Về hiệu năng, Nemotron 3.5 Lightning đạt tốc độ đầu ra gần 670 token/giây, nhanh gấp 4 lần so với các mô hình mã nguồn mở cùng loại, giúp rút ngắn 30% thời gian hoàn thành tác vụ của AI tác tử. Trên chỉ số thông minh của Artificial Analysis, mô hình đạt 24 điểm, tăng 9 điểm so với thế hệ trước, với hiệu năng tương đương gpt-oss-120b dù số lượng tham số chỉ bằng khoảng một phần tư.
Đồng thời, NVIDIA đã phát hành thư viện định tuyến mô hình mã nguồn mở NeMo Switchyard, giúp giảm chi phí tác vụ xuống còn gần một phần ba so với việc chạy riêng lẻ Opus 4.8, qua đó nâng cao hơn nữa hiệu suất của các AI agent. Các báo cáo mới nhất bổ sung rằng mô hình này đạt độ chính xác 86% trên PinchBench, xử lý 10 nghìn tác vụ nhanh hơn 30% so với Qwen3.6 35B và trọng số đã được đăng tải lên HuggingFace.
Tổng thuật do AI tổng hợp từ toàn bộ bài đưa tin, cập nhật theo diễn biến · làm mới T4 · 12/08 · 14:34.
Diễn biến mới nhất
Các báo cáo mới nhất đã bổ sung thêm thông tin chi tiết về PinchBench với độ chính xác 86% và tốc độ nhanh hơn 30% so với Qwen3.6 35B, đồng thời xác nhận các trọng số đã được đăng tải trên HuggingFace.
Chính chủ · 2 bài
Nghe trực tiếp từ bên liên quan
- NVIDIA BlogNVIDIA ra mắt Nemotron 3.5 Lightning và NeMo Switchyard, nâng cao hiệu suất cho AI tác tử
- NVIDIA BlogNVIDIA giới thiệu Nemotron 3.5 Lightning, tăng tốc các tác vụ AI tác tử cục bộ
Dòng thời gian đưa tin
Đang hiện 9 bài · tất cả · mới trước
T4 · 12/08
NVIDIA ra mắt Nemotron 3.5 Lightning: Mô hình MoE mã nguồn mở 30B cùng bộ định tuyến mô hình NeMo Switchyard
MarkTechPostNVIDIA giới thiệu Nemotron 3.5 Lightning, một mô hình mã nguồn mở với kiến trúc kết hợp Mamba-2 + MoE + Attention, sở hữu 30 tỷ tham số (3 tỷ tham số hoạt động). Mô hình hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token, được phát hành theo giấy phép OpenMDW-1.1 và cho phép sử dụng cho mục đích thương mại.
NVIDIA ra mắt mô hình AI mã nguồn mở Nemotron 3.5 Lightning với 30 tỷ tham số
IT HomeNVIDIA giới thiệu mô hình MoE mã nguồn mở Nemotron 3.5 Lightning với 30 tỷ tham số, được thiết kế chuyên biệt cho các tác vụ cụ thể trong hệ thống đa tác nhân (multi-agent) quy mô lớn. So với các mô hình cùng loại, tốc độ xuất dữ liệu của nó tăng tới 4 lần, giúp đẩy nhanh tốc độ hoàn thành tác vụ tổng thể của các tác nhân lên 30%. Mô hình này có thể chạy trực tiếp trên các thiết bị cục bộ như NVIDIA RTX PC, DGX Spark, hoặc mở rộng sang môi trường AI biên và trung tâm dữ liệu.
Bản tin sáng BestBlogs: NVIDIA ra mắt Nemotron 3.5 Lightning, lượng người dùng hàng tháng của Gemini vượt mốc 1 tỷ
X: Hongming (@hongming731)NVIDIA công bố Nemotron 3.5 Lightning, mô hình MoE 30B chỉ kích hoạt 3B tham số mỗi lần chạy, tối ưu cho các tác vụ tần suất cao của tác nhân AI thường trực. Trong thử nghiệm Switchyard của LangChain, mô hình 30B này đảm nhận 93% khối lượng yêu cầu, với chi phí rẻ hơn 74% so với Claude Opus 4.8. Ứng dụng Gemini đã đạt hơn 1 tỷ người dùng hàng tháng, trở thành sản phẩm thứ 14 của Google cán mốc quan trọng này.
NVIDIA mã nguồn mở Nemotron 3.5 Lightning, giúp giảm chi phí thực thi của AI Agent xuống còn 1/3
X: AI Notes (@AYi_AInotes)NVIDIA ra mắt mô hình mã nguồn mở Nemotron 3.5 Lightning với tổng cộng 30 tỷ tham số, trong đó mỗi lần chỉ kích hoạt 3 tỷ tham số. Mô hình được thiết kế chuyên biệt cho lớp thực thi của các AI Agent hoạt động 24/7, với tốc độ nhanh gấp 4 lần các mô hình cùng phân khúc, độ chính xác trên PinchBench đạt 86% và xử lý 10 nghìn tác vụ nhanh hơn 30% so với Qwen3.6 35B.
T3 · 11/08
NVIDIA ra mắt mô hình mã nguồn mở Nemotron 3.5 Lightning
X: Testing Catalog (@testingcatalog)NVIDIA vừa phát hành Nemotron 3.5 Lightning, một mô hình MoE 30B mã nguồn mở với chỉ 3B tham số kích hoạt, được thiết kế chuyên biệt cho các tác nhân (agent) thực hiện tác vụ tần suất cao. Tốc độ xuất dữ liệu của mô hình này nhanh gấp 4 lần so với các đối thủ cùng phân khúc, nhanh hơn 35% so với Qwen3.6 35B trong khi vẫn duy trì hiệu suất tương đương. Trọng số của mô hình hiện đã có mặt trên HuggingFace.
Nvidia ra mắt Nemotron 3.5 Lightning: Ưu tiên tốc độ hơn trí tuệ tối thượng
The Decoder: AI NewsNvidia vừa phát hành Nemotron 3.5 Lightning, mẫu model đầu tiên thuộc dòng Nemotron 3.5 với tổng cộng 31,6 tỷ tham số, trong đó số tham số kích hoạt chỉ là 3,6 tỷ. Model này đạt 24 điểm trên chỉ số thông minh của Artificial Analysis, ngang bằng với gpt-oss-120b của OpenAI, nhưng tốc độ suy luận đạt gần 670 tokens mỗi giây, mức cao nhất trong các model được so sánh.
NVIDIA ra mắt mẫu Nemotron 3.5 đầu tiên mang tên Lightning, hiệu năng ngang ngửa gpt-oss-120b
X: Artificial Analysis (@ArtificialAnlys)NVIDIA ra mắt mẫu Nemotron 3.5 đầu tiên mang tên Lightning, với tổng số 31.6 tỷ tham số (3.6 tỷ tham số kích hoạt), hiệu năng ngang ngửa gpt-oss-120b dù số lượng tham số chỉ bằng khoảng một phần tư. Mô hình đạt 24 điểm trên chỉ số thông minh của Artificial Analysis, tăng 9 điểm so với thế hệ trước, tốc độ đầu ra gần 670 token/giây, hỗ trợ cửa sổ ngữ cảnh 1 triệu token và sử dụng giấy phép thương mại OpenMDW-1.1.
NVIDIA ra mắt Nemotron 3.5 Lightning và NeMo Switchyard, nâng cao hiệu suất cho AI tác tử
NVIDIA BlogChính chủNVIDIA mở rộng dòng mô hình Nemotron 3 bằng việc giới thiệu Nemotron 3.5 Lightning, mô hình hỗn hợp chuyên gia với 30 tỷ tham số, hướng tới các khối lượng công việc AI tác tử có lưu lượng cao. Tốc độ đầu ra của mô hình tăng gấp 4 lần và tốc độ hoàn thành tác vụ tăng 30%. Cùng lúc đó, hãng cũng phát hành thư viện định tuyến mô hình mã nguồn mở NeMo Switchyard, giúp giảm chi phí tác vụ xuống còn gần một phần ba so với việc chạy riêng lẻ Opus 4.8, đồng thời hỗ trợ triển khai trên các thiết bị cục bộ như RTX PC và DGX.
NVIDIA giới thiệu Nemotron 3.5 Lightning, tăng tốc các tác vụ AI tác tử cục bộ
NVIDIA BlogChính chủNVIDIA vừa ra mắt Nemotron 3.5 Lightning, một mô hình hỗn hợp chuyên gia (MoE) 30B mã nguồn mở có khả năng tùy biến cao, được thiết kế chuyên biệt cho các tác nhân thông minh (AI agents) thường trực. So với các mô hình mã nguồn mở cùng loại, tốc độ tạo token của Nemotron 3.5 Lightning tăng tới 4 lần, giúp rút ngắn 30% thời gian hoàn thành tác vụ. Mô hình này được phát hành với trọng số mở, cho phép người dùng tinh chỉnh để phù hợp với các nhiệm vụ cụ thể và có thể vận hành trên nhiều thiết bị như RTX PC, DGX Spark và Jetson.