IT Home ITHome
85

Tin ngành

Microsoft nâng tầm tầm nhìn của Bill Gates: Mang trí tuệ nhân tạo không giới hạn đến mọi bàn làm việc

(giờ Việt Nam)

Tóm tắt AI

Microsoft đang tái định nghĩa tầm nhìn của Bill Gates từ việc phổ cập máy tính cá nhân sang phổ cập AI cục bộ, cho phép các thiết bị chạy mô hình thông minh trực tiếp mà không phụ thuộc hoàn toàn vào đám mây.

Bản dịch AI

Theo tin từ IT ngày 8 tháng 9, đã hơn 6 năm kể từ khi Bill Gates chính thức cắt đứt mọi quan hệ ở cấp độ doanh nghiệp với Microsoft, nhưng tầm nhìn mà ông đề ra cách đây 40 năm vẫn đang phát huy tác dụng, chỉ là giờ đây Microsoft đã khoác lên nó những mục tiêu vĩ đại hơn.

"Nếu bạn còn nhớ tầm nhìn của Bill Gates khi ông còn chèo lái Microsoft, đó chính là đưa một chiếc PC lên mỗi bàn làm việc, vào mỗi gia đình," Mark Linton, Phó chủ tịch doanh nghiệp phụ trách mảng Windows và thiết bị của Microsoft, chia sẻ với khán giả tại IFA 2026. Sau đó, ông nói về tầm nhìn mới của Microsoft trong những năm tới: "Điều chúng tôi đang nói đến hiện nay là mang trí tuệ không giới hạn đến mọi bàn làm việc, mọi gia đình."

"Trí tuệ không giới hạn" mà Linton đề cập đến nghĩa là AI không còn phụ thuộc vào chi phí và độ trễ do suy luận trên đám mây mỗi khi sử dụng. Một chiếc PC có hiệu năng đủ mạnh có thể chạy trực tiếp các mô hình AI hàng ngày ngay tại máy, trong khi đám mây sẽ dành cho những tác vụ thực sự cần đến sức mạnh điện toán đám mây.

Điều thú vị là vào ngày 1 tháng 6, CEO Satya Nadella của Microsoft cũng bày tỏ một ý tưởng tương tự với tầm nhìn của Gates cách đây vài thập kỷ: "Mục tiêu của chúng tôi thông qua Windows là mang trí tuệ không giới hạn đến mọi gia đình, mọi bàn làm việc."

IT lưu ý rằng tầm nhìn của Gates năm xưa đã phải mất một thời gian khá dài mới thành hiện thực, còn ngày nay, chúng ta thậm chí đã có thể đặt siêu máy tính vào trong lòng bàn tay. Khẩu hiệu của Microsoft năm 1977 là "đưa một chiếc máy tính chạy phần mềm Microsoft lên mỗi bàn làm việc, vào mỗi gia đình". Tuy nhiên, Nadella sau đó cho biết phần "chạy phần mềm Microsoft" luôn khiến ông cảm thấy không thoải mái, vì nó "đánh đồng một sứ mệnh lâu dài với một mục tiêu mang tính giai đoạn". Ngày nay, "trí tuệ không giới hạn" có vẻ chính là chương thứ hai mà Microsoft đang cố gắng mở ra cho sứ mệnh này.

Bill Gates muốn máy tính hiện diện ở khắp mọi nơi, còn ngày nay Microsoft muốn AI cục bộ cũng hiện diện ở khắp mọi nơi.

Gates từng tin rằng tiềm năng của PC gần như không có giới hạn, nó có thể xử lý văn bản, con số, hình ảnh và cuối cùng là cả video động, đồng thời mở rộng thêm nhiều công dụng khi sức mạnh tính toán không ngừng tăng lên. Tầm nhìn năm xưa giải quyết vấn đề giúp mọi người tiếp cận được sức mạnh tính toán, còn tầm nhìn mới ngày nay là giúp mọi người tiếp cận được trí tuệ.

Tất nhiên, cái gọi là "không giới hạn" không có nghĩa là chúng ta có thể ngừng trả phí đăng ký Claude. Tuyên bố của Microsoft tại Build 2026 đã khá rõ ràng: các mô hình tiên tiến nhất sẽ xử lý những vấn đề phức tạp và hiện đại nhất, trong khi các tác vụ khác sẽ được chạy trực tiếp trên thiết bị nhiều nhất có thể.

Windows ML sẽ giúp tầm nhìn này thích ứng với các cấp độ phần cứng khác nhau. Nếu một mô hình AI nhỏ hoặc trung bình có thể chạy trực tiếp tại máy, người dùng sẽ không cần phải gửi yêu cầu đến mô hình từ xa mỗi lần sử dụng, cũng không cần phải trả phí theo số lượng Token. Đồng thời, độ trễ cũng sẽ giảm đi đáng kể. "Kinh tế học Token" mà Linton nhắc đến cũng bao hàm ý nghĩa này.

Microsoft và NVIDIA xác nhận tại Build 2026 rằng, theo lời CEO Jensen Huang của NVIDIA, RTX Spark với hiệu năng AI đạt 1 PFLOPS, tối đa 6144 nhân Blackwell, 20 nhân CPU Arm và bộ nhớ thống nhất lên đến 128GB, đã đủ khả năng để tải cục bộ các mô hình có hàng trăm tỷ tham số.

Để đạt được mục tiêu này, Windows 11 cần phần cứng hoàn toàn mới và khối lượng công việc phần mềm khổng lồ.

Linton tóm tắt công việc hiện tại của Microsoft thành ba phần: trải nghiệm nhà phát triển, tính bảo mật của AI Agent tự chủ và nền tảng AI.

Về phần cứng, trước hết bắt đầu từ RTX Spark. Surface RTX Spark Dev Box của Microsoft đã tích hợp toàn bộ sức mạnh của con chip này vào một chiếc máy tính để bàn dành cho nhà phát triển.

Surface Laptop Ultra là dòng laptop flagship của Microsoft được trang bị RTX Spark, trong khi Windows Latest trước đó đã tiết lộ Lenovo Yoga Pro 9n, sau đó là Yoga 9n 2-in-1, điều này có nghĩa là RTX Spark sẽ không chỉ giới hạn ở các thiết bị máy trạm.

Microsoft đã thiết kế lại bộ lập lịch (scheduler) và cơ chế quản lý bộ nhớ của Windows để phù hợp với kiến trúc CPU, GPU và bộ nhớ thống nhất đặc biệt của con chip này. Trong đó, Workload Profile Scheduling có thể phân bổ khối lượng công việc cho toàn bộ 20 nhân CPU.

Project Zenith được Microsoft công bố vào ngày 4 tháng 9 đã đặt yêu cầu tối thiểu là 64GB bộ nhớ thống nhất và băng thông bộ nhớ 250GB/s. Microsoft cho biết các thiết bị đáp ứng yêu cầu có thể chạy cục bộ các mô hình có 30 tỷ tham số hoặc hơn, đồng thời hiện thực hóa việc sử dụng "không giới hạn". Đây cũng là sự thể hiện cụ thể ở cấp độ phần cứng cho tầm nhìn mà Linton mô tả.

Tuy nhiên, các dòng laptop Windows phổ thông vẫn còn cách mục tiêu này rất xa. Yêu cầu tối thiểu 64GB RAM đã cao hơn nhiều so với các sản phẩm chủ đạo, và phần cứng cấp độ RTX Spark cũng không hề rẻ.

Microsoft đang cố gắng biến Windows thành hệ điều hành cho AI Agent cục bộ.

Trụ sở Microsoft tại Redmond rõ ràng hiểu rất rõ rằng các khách hàng doanh nghiệp không muốn AI Agent tự chủ chạy tự do trong toàn bộ mạng lưới công ty. Giải pháp mà Microsoft đưa ra là Microsoft Execution Containers, thông qua việc cô lập và đóng gói (containerize) AI Agent, thực thi các chính sách liên quan và ghi lại các thao tác của chúng, đưa tất cả các khả năng này vào hệ thống bảo mật của Windows. Hệ thống này được xây dựng bởi Microsoft cùng với NVIDIA và các đối tác chip khác.

NVIDIA cũng đang đưa khung làm việc OpenShell Agent của mình vào hệ thống này, trong đó Hermes Agent và OpenClaw đều sẽ được tích hợp trực tiếp.

Windows Foundry cho phép nhà phát triển lựa chọn các mô hình khác nhau, Windows cung cấp mặc định các mô hình tích hợp sẵn trong hệ thống, còn Windows AI Subsystem chịu trách nhiệm điều phối và sắp xếp toàn bộ quá trình. Phần cứng mạnh mẽ, Windows ML, mô hình cục bộ, AI Agent, cộng với hệ thống bảo mật Windows được xây dựng xung quanh các khả năng này, đó chính là toàn bộ ngăn xếp công nghệ (tech stack) mà Linton mô tả.

Hai trải nghiệm Windows hoàn toàn khác biệt đang phát triển theo hướng ngược nhau.

Linton cũng cho biết Microsoft đang "tối ưu hóa Windows để các máy có 8GB RAM cũng có thể chạy tốt". Thoạt nhìn, điều này dường như không liên quan gì đến việc chạy cục bộ mô hình 120 tỷ tham số, nhưng thực tế, đây chính là mặt kia của cùng một chiến lược.

Project Zenith bắt đầu từ 64GB RAM, RTX Spark hỗ trợ tối đa 128GB RAM. Ngược lại, Microsoft đồng thời cũng đang nỗ lực để các thiết bị 8GB RAM duy trì trải nghiệm sử dụng tốt, giữa hai bên tồn tại một khoảng cách khổng lồ. Hy vọng duy nhất lúc này là thời gian để Microsoft lấp đầy khoảng cách đó sẽ không kéo dài như tầm nhìn "mỗi bàn làm việc, mỗi gia đình một chiếc PC" năm xưa.

Sứ mệnh năm xưa của Microsoft là giúp mọi người có thể sở hữu một chiếc máy tính trong tầm tay, và Nadella cũng thừa nhận rằng mục tiêu này cuối cùng đã vượt quá thời hạn đặt ra ban đầu. Ngày nay, Microsoft hy vọng đưa PC tiến xa hơn để trở thành cơ sở hạ tầng AI: chạy mô hình AI cục bộ, lưu trữ AI Agent và chỉ chuyển tác vụ lên đám mây khi thực sự cần thiết.

Nút thắt lớn nhất hiện nay có lẽ là phần cứng đắt đỏ, nhưng hướng phát triển của Microsoft đã rất rõ ràng.

MicrosoftAI cục bộTầm nhìn công nghệWindowsTrí tuệ nhân tạo
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.