Tin ngành
CTO Mozilla: AI nên được xây dựng theo mô hình mở như cách Internet vận hành
(giờ Việt Nam)
Tóm tắt AI
Raffi Krikorian nhận định rằng trong khi người dùng cá nhân ưa chuộng ChatGPT hay Claude, các doanh nghiệp đang dần chuyển hướng sang các mô hình mở để có toàn quyền tùy chỉnh và kiểm soát dữ liệu.
Bản dịch AI

Trong nhiều thập kỷ, Mozilla luôn là một trong những tổ chức ủng hộ mạnh mẽ nhất cho một internet mở. Ngày nay, khi trí tuệ nhân tạo (AI) ngày càng trở nên quan trọng đối với cách thức vận hành của các doanh nghiệp và chính phủ, tổ chức này cũng đang đưa ra những lập luận tương tự cho AI mở.
Trong một báo cáo được công bố vào tháng trước, Mozilla, một cộng đồng phần mềm tự do và là dự án phi lợi nhuận, cho biết khoảng cách về hiệu suất giữa các mô hình mã nguồn mở hàng đầu và các hệ thống độc quyền như Claude và ChatGPT đã thu hẹp xuống chỉ còn 3%. Báo cáo nhấn mạnh sự phổ biến ngày càng tăng của các mô hình mở, lưu ý rằng vào tháng 2 năm 2026, mô hình mã nguồn mở Qwen của Alibaba đã được tải xuống nhiều hơn tổng số lượt tải của tám mô hình tiếp theo cộng lại.
Cuộc tranh luận về AI mở đã có thêm động lực mới sau khi Meta phát hành một mô hình trọng số mở (open-weight) mới vào ngày 10 tháng 8 và hứa hẹn sẽ còn nhiều mô hình khác ra mắt trong thời gian tới.
Raffi Krikorian, Giám đốc công nghệ của Mozilla, tin rằng các tổ chức cần những giải pháp thay thế cho các hệ thống AI độc quyền để giành quyền kiểm soát tốt hơn đối với dữ liệu và cơ sở hạ tầng của họ.
Trong suốt sự nghiệp của mình — từ việc lãnh đạo các đội ngũ kỹ thuật tại X (trước đây là Twitter) đến làm việc về xe tự hành tại Uber và hiện tại là định hình tầm nhìn cho Mozilla — Krikorian đã làm việc với các công nghệ đột phá và ý nghĩa của chúng đối với người tiêu dùng. Trong cuộc trò chuyện với Rest of World, ông đã thảo luận về lý do tại sao các nhà hoạch định chính sách cần xem AI là cơ sở hạ tầng thay vì một sản phẩm, lý do tại sao các doanh nghiệp ngày càng thử nghiệm với các mô hình mở và mô hình trọng số mở, cũng như vai trò mà ông tin rằng công nghệ này sẽ đóng góp trong thế hệ sản phẩm và dịch vụ tiếp theo.
Cuộc trò chuyện đã được biên tập lại để đảm bảo độ dài và sự rõ ràng. Bản ghi âm sự kiện trực tiếp của Rest of World có sẵn tại đây.
Ông từng nói rằng AI mã nguồn mở không còn là một “hệ sinh thái dành cho người chơi nghiệp dư” nữa mà đã có một lớp thương mại trị giá hàng trăm tỷ đô la. Ông dựa trên cơ sở nào để đưa ra nhận định này?
Đó có khả năng là một trong những bí mật được giữ kín nhất hiện nay.
Khi bạn nói về mã nguồn mở trong một số giới nhất định, thường là các giới chính sách chính phủ, họ sẽ nói những câu đại loại như: “Ồ, đó chỉ là mấy đứa trẻ trong tầng hầm thôi, phải không?”. Hệ sinh thái này không phải như vậy. Những doanh nghiệp này đang xây dựng các nền kinh tế, cơ sở hạ tầng, sản phẩm và công nghệ khổng lồ.
Nó giống như Linux, vốn bắt đầu chỉ với một nhân (kernel) và không được coi trọng lắm. Nhưng Google đã có thể lấy Linux để tạo ra Android, và giờ đây, xét trên mọi khía cạnh thực tế, mọi máy tính trên hành tinh đều chạy trên Linux. Mỗi chiếc máy bán hàng tự động mới có lẽ cũng đang chạy trên Linux.
Chúng ta đang thấy điều tương tự trong thế giới AI mã nguồn mở và trọng số mở. Chính vì chiến dịch tiếp thị rầm rộ của các phòng thí nghiệm tiên phong lớn mà tất cả chúng ta đều coi AI chỉ là thứ mà Anthropic, OpenAI và một vài công ty khác đang thực hiện. Thực tế, có một hệ sinh thái đang phát triển mạnh mẽ ở phía mã nguồn mở và trọng số mở mà rất nhiều người thực sự biết đến.
Đó có khả năng là một trong những bí mật được giữ kín nhất hiện nay trong lĩnh vực công nghệ.
Tại sao không có nhiều người làm quen với các công cụ mã nguồn mở hơn?
Có sự khác biệt giữa những gì người tiêu dùng đang làm và những gì các doanh nghiệp bắt đầu thực hiện.
Đúng là một cá nhân — như thư ký hoặc nhân viên văn phòng khác — có lẽ đang sử dụng ChatGPT và Claude. Nhưng các quy trình làm việc mà một đội ngũ IT hoặc nhân sự bắt đầu xây dựng lại đang chuyển dịch sang các mô hình mở vì lý do hiệu suất trên giá thành, hoặc có thể vì các ngành công nghiệp được quản lý chặt chẽ muốn có toàn quyền kiểm soát dữ liệu và cách thức dữ liệu luân chuyển. Họ muốn tự lưu trữ (self-host) và giữ mọi thứ nằm trong tường lửa của mình. Họ đang tìm kiếm khả năng triển khai mọi thứ dưới sự kiểm soát của chính họ.
Tôi không có câu trả lời thỏa đáng cho việc tại sao mọi người không "la hét trên mái nhà" rằng họ đang tiết kiệm được tất cả số tiền đó.
Phải chăng mọi người không công khai nói về các mô hình mã nguồn mở vì nhiều trong số đó là của Trung Quốc và có những vấn đề về quy định hoặc lòng tin đối với các công cụ này?
Chúng tôi không có bằng chứng cụ thể rằng điều đó là đúng, nhưng tôi nghĩ bạn có thể suy luận rằng đó là sự thật.
Các mô hình AI mã nguồn mở rất phức tạp để hiểu, và tôi nghĩ đó cũng là một phần của vấn đề. Khi bạn nhìn vào các mô hình này, nó giống như việc tải xuống một mô hình bạn muốn chạy, giống như một tệp tin, vào máy tính của mình. Vì vậy, tôi có thể hiểu tại sao mọi người — nếu họ không thực sự hiểu công nghệ này hoạt động như thế nào — có thể lo lắng về việc tải xuống phần mềm độc hại có thể làm rò rỉ dữ liệu của họ ở một số nơi.
Đó không phải là cách các hệ thống thực sự hoạt động. Nhưng lời giải thích đơn giản nhất thường là lời giải thích cuối cùng giành chiến thắng.
Và tôi cũng tin rằng có điều gì đó về Trung Quốc nói chung đang làm cho phương trình này trở nên khó hiểu hơn một chút. Điều đáng nói ở đây lẽ ra phải là tại sao không có nhiều quốc gia và tổ chức hơn cố gắng đáp ứng nhu cầu đó? Nếu một lượng lớn lưu lượng truy cập đang đổ vào một mô hình mà mọi người muốn nó mở, thì bạn có thể hình dung ra một thế giới nơi các công ty Mỹ, Ấn Độ hoặc châu Âu cũng nên cố gắng đáp ứng nhu cầu đó.
Trong bối cảnh lo ngại về phần mềm Trung Quốc, ông có nghĩ rằng các chính phủ — đặc biệt là Washington — hiểu rằng mã nguồn mở đang trở nên phổ biến như vậy không?
Tôi thực sự nghĩ rằng chính phủ hiểu những gì đang xảy ra. Nhưng họ đang bị mắc kẹt giữa việc “chúng ta có muốn để các đơn vị nắm giữ tiêu chuẩn hiện tại của mình giành chiến thắng hay không” hoặc “chúng ta có muốn chấp nhận rủi ro và cố gắng trở thành một yếu tố mang tính chuyển đổi cho hệ sinh thái hay không”.
Tôi nghĩ thật đơn giản để hiểu rằng chúng ta có hai công ty đang hoạt động cực kỳ tốt, đang chạy đua để niêm yết công khai vào cuối năm nay hoặc đầu năm sau, và chúng ta muốn họ giành chiến thắng. Và chính phủ đang bị vận động hành lang rất mạnh mẽ về vấn đề đó.
Vì vậy, điều đơn giản nhất cần làm là ủng hộ những người mà họ đã coi là người chiến thắng.
Nhưng tôi muốn nói rằng người Mỹ thường phân loại AI như một sản phẩm. Sản phẩm theo định nghĩa là những thứ bạn có thể thuê hoặc tắt đi, nhưng nó nên được phân loại là cơ sở hạ tầng, đó là thứ mà phần còn lại của thế giới dường như muốn mua. Sai lầm trong việc phân loại đó thực sự là vấn đề. Chúng ta nên cố gắng đáp ứng nhu cầu đó theo một cách nào đó, và tôi thất vọng vì chính phủ của tôi không thể thấy sự khác biệt đó ngay bây giờ, và họ đang chọn cách làm đơn giản nhất.
Liệu mã nguồn mở có thực sự mở cho tất cả mọi người?
Tôi thừa nhận rằng chúng ta đang bỏ qua cuộc trò chuyện về mã nguồn mở và trọng số mở. Có định nghĩa nghiêm ngặt nhất về mã nguồn mở, đó là việc hiểu tất cả dữ liệu được sử dụng để huấn luyện, tất cả các hệ thống đánh giá, và quá trình tiền huấn luyện (pre-training) và hậu huấn luyện (post-training) diễn ra như thế nào. Tôi nghĩ điều đó cực kỳ quan trọng và chúng ta cần đầu tư nhiều hơn để hiện thực hóa điều đó. Đó là điều sẽ dẫn đến sự tin tưởng và minh bạch, và chúng ta có thể cảm thấy thực sự yên tâm về mặt đạo đức đối với chúng.
Tôi không đổ lỗi cho những gì các công ty lớn đang làm, nhưng họ sẽ tối ưu hóa cho những nơi mà họ có thể kiếm được nhiều tiền nhất.
Hiện tại, phần lớn những gì chúng ta đang nói đến là các hệ thống trọng số mở. Vì vậy, chúng ta không có cái nhìn rõ ràng về tất cả dữ liệu — tiền huấn luyện và hậu huấn luyện. Nhưng những gì chúng ta có là khả năng tải xuống, chạy, thực thi, và sau đó sửa đổi và tinh chỉnh (fine-tune). Việc tinh chỉnh đó là nơi phần còn lại của thế giới phát huy tác dụng. Con đường để có các mô hình thực sự mang tính địa phương và AI địa phương phản ánh giá trị của người dùng là lấy các mô hình trọng số mở lớn này và tinh chỉnh chúng cho các trường hợp sử dụng của chúng ta về ngôn ngữ chúng ta nói hoặc các giá trị của một cộng đồng. Công nghệ ở đó vẫn cần được cải thiện. Vì vậy, nếu bạn là một nhà khoa học máy tính, bạn có thể làm được, nhưng nếu bạn là một nhà lãnh đạo cộng đồng, bạn có thể không làm được.
Tôi không đổ lỗi cho những gì các công ty lớn đang làm, nhưng họ sẽ tối ưu hóa cho những nơi mà họ có thể kiếm được nhiều tiền nhất. Vì vậy, họ sẽ tối ưu hóa cho thế giới phương Tây và có thể là một phần của châu Á, nhưng họ sẽ không tối ưu hóa cho phần còn lại của thế giới. Phần còn lại của thế giới chỉ trở thành một phần của cuộc trò chuyện chuyển đổi AI này thông qua hệ sinh thái mã nguồn mở và trọng số mở.
Mozilla đã bảo vệ web mở trong nhiều thập kỷ. Tuy nhiên, Google chiếm 90% thị phần tìm kiếm, Meta đã chiếm lĩnh mạng xã hội và Amazon vận hành phần lớn hạ tầng đám mây. Tại sao bất kỳ ai nên tin rằng AI mã nguồn mở sẽ có kết cục khác?
Sự tồn tại của những thứ như Firefox đã thúc đẩy toàn bộ ngành công nghiệp. Một người như Google không thể xây dựng một phiên bản web đóng vì cộng đồng người dùng Firefox sẽ đứng lên và nói rằng bạn không thể làm như vậy. Những con số đó đủ để buộc và giữ cho internet ở trạng thái giao thức mở và không mang lại lợi ích cho bất kỳ công ty cụ thể nào ở cấp độ cơ sở hạ tầng nền tảng đó.
Tôi muốn động lực tương tự xảy ra trên internet AI. Bạn có thể lập luận rằng chúng ta có một lượng lưu lượng truy cập nhỏ trên internet AI thông qua các mô hình mở, nhưng điều đó sẽ đủ để thúc đẩy một cuộc trò chuyện xung quanh việc lựa chọn mô hình, lựa chọn công cụ tác nhân (agentic harness), quyền tự quyết của người dùng và đảm bảo rằng bộ nhớ nằm ở phía tôi, chứ không phải phía người dùng. Bạn có thể lập luận rằng chỉ cần một lượng lưu lượng truy cập nhỏ để thực hiện điều đó, nhưng tôi cũng muốn nói rằng một lượng lớn lưu lượng truy cập đã và đang chuyển sang mô hình mở.
Ông nghĩ công ty AI lớn nhất năm 2031 sẽ làm gì? Xây dựng mô hình, bộ nhớ, công cụ cho nhà phát triển, tác nhân, cơ sở hạ tầng, hay một thứ gì đó hoàn toàn khác?
Tôi nghĩ sẽ có sự lan tỏa. Chúng ta sẽ thấy rằng nhà cung cấp lớn nhất là người cung cấp một phiên bản trí tuệ mở mà mọi công ty đều có thể sử dụng và tùy chỉnh — tương tự như cách chúng ta có gói đăng ký Google Drive hoặc giải pháp Microsoft Office 365 hiện nay. Đó sẽ là một nhà cung cấp dịch vụ có thể bước vào một công ty và giúp họ thực sự vượt qua rào cản đó để sử dụng AI.
Bài viết được AI dịch và tổng hợp tự động từ Rest of World. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.