Sản phẩm
NVIDIA ra mắt PAIR: Giải pháp điều phối AI cục bộ trên Mac và PC RTX
(giờ Việt Nam)
Tóm tắt AI
NVIDIA vừa giới thiệu Personal AI Router (PAIR), phần mềm mã nguồn mở giúp điều phối các tác vụ AI cục bộ qua mạng LAN, tự động phân bổ yêu cầu đến các thiết bị rảnh rỗi như Mac hoặc PC chạy RTX để tối ưu hóa hiệu suất xử lý đồng thời.
Bản dịch AI
Theo tin từ IT ngày 4 tháng 9, trang tin công nghệ AppleInsider hôm qua (3 tháng 9) đã đăng tải bài viết cho biết Nvidia vừa ra mắt phần mềm Personal AI Router (PAIR) dưới dạng bản thử nghiệm mã nguồn mở. Phần mềm này được sử dụng để lựa chọn các máy tính khả dụng trong mạng nội bộ (LAN) nhằm xử lý các yêu cầu AI cục bộ, tương tự như một điều phối viên phân bổ công việc cho các vị trí đang rảnh rỗi.
Trên các thiết bị tương thích, phần mềm này có thể chạy trên các thiết bị Mac dùng chip M4 trở lên, PC trang bị Nvidia RTX và các thiết bị DGX Spark, cung cấp một cổng tiếp nhận yêu cầu thống nhất cho các công cụ AI cục bộ như Ollama và LM Studio. Người dùng có thể điều phối nhiều yêu cầu AI độc lập đến các thiết bị đang rảnh rỗi trong mạng nội bộ gia đình hoặc văn phòng. IT đính kèm ảnh chụp màn hình liên quan bên dưới:

Về định vị sản phẩm, Nvidia định vị PAIR là phần mềm điều phối yêu cầu AI cục bộ trong mạng LAN, có khả năng tự động phát hiện các máy tính đã kết nối và phân bổ từng yêu cầu cho thiết bị khả dụng. Các mô hình vẫn được vận hành bởi Ollama hoặc LM Studio trên thiết bị đích, vì vậy người dùng không cần phải cấu hình riêng lẻ cho từng máy đối với mỗi ứng dụng AI.
Khi một thiết bị bận hoặc không khả dụng, PAIR có thể chuyển hướng các yêu cầu mới sang các thiết bị đã ghép nối khác. Ví dụ, khi một AI agent cùng lúc xem xét nhiều tài liệu, nó có thể giao các tác vụ độc lập cho các máy tính khác nhau xử lý. Cơ chế này hướng tới việc chia sẻ tải trọng đồng thời, không có nghĩa là tốc độ phản hồi của một AI đơn lẻ sẽ tự động nhanh hơn khi thêm nhiều máy tính vào hệ thống.
Bản demo của Nvidia cho thấy, khi sử dụng Ollama với mô hình Qwen 3.6 35B A3B trong Hermes và chia nhỏ tác vụ cho 5 AI sub-agent, thời gian hoàn thành trung bình trên một máy tính xách tay RTX Spark là 18 phút; sau khi kết hợp thêm DGX Spark và RTX 5090, thời gian trung bình giảm xuống còn 8 phút 48 giây.

Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.