QbitAI
85

Tin ngành

Microsoft siết chặt 'Tokenmaxxing': Cắt giảm ngân sách, nhân viên tự chịu phí nếu dùng quá hạn mức

(giờ Việt Nam)

Tóm tắt AI

Microsoft vừa ra lệnh hạn chế việc tiêu tốn token quá mức trong nội bộ, yêu cầu nhân viên phải tự chi trả nếu vượt định mức, đồng thời tiết lộ các dự án đang thử nghiệm mô hình GPT-5.6.

Bản dịch AI

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

05/08/2026 14:33:40 Nguồn: QbitAI

Mặc định sử dụng GPT-5.6 nội bộ

Ting Yu đưa tin từ trụ sở QbitAI | Kênh chính thức QbitAI

Không đời nào, đến cả Microsoft cũng bắt đầu phải xót xa vì token rồi sao??

Theo các email nội bộ, từ tháng 7 năm nay, Microsoft đã thiết lập "mục tiêu ngân sách AI Token" cho các bộ phận kinh doanh.

Họ cũng đặt GPT-5.6 làm mô hình mặc định nội bộ với lý do là nó rẻ hơn.

Microsoft ơi, thế là ông chưa được chứng kiến sức mạnh huyền bí đến từ phương Đông rồi.

Nếu nói về độ rẻ, sao ông không dùng thẳng DeepSeek đi…

Phó chủ tịch điều hành Microsoft, Jay Parikh, cũng đã đích thân lên tiếng trong nội bộ:

Tokenmaxxing không phải là mục tiêu tối ưu hóa của chúng ta.

Tại Microsoft, dùng AI cũng phải thắt lưng buộc bụng

Theo email nội bộ của Parikh và hướng dẫn sử dụng Copilot đã được cập nhật, chính sách mới của Microsoft có thể chia thành vài điểm:

Thứ nhất, thiết lập ngân sách. Từ tháng 7 năm 2026, các bộ phận kinh doanh của Microsoft đều có "mục tiêu ngân sách AI token".

Tuy nhiên, con số mục tiêu chi tiêu cụ thể hiện vẫn chưa được công bố.

Thứ hai, minh bạch hóa chi phí. Nhân viên có thể xem mức chi tiêu AI token cá nhân của mình.

Dữ liệu nội bộ cho thấy, nhiều kỹ sư tiêu tốn từ vài trăm đến vài nghìn đô la Mỹ tiền token mỗi tháng.

Thứ ba, thay đổi mô hình mặc định. Mô hình mặc định nội bộ đã được chuyển từ các tùy chọn trước đây sang GPT-5.6, vì lý do rẻ hơn các mô hình khác.

Chưa dừng lại ở đó, Microsoft cho biết có thể sẽ áp dụng thêm các hạn chế khác dựa trên tình hình giám sát trong thời gian tới.

Parikh viết trong email nội bộ: "Hãy quản lý chi tiêu token giống như cách quản lý mọi nguồn lực quan trọng khác".

Ông yêu cầu nhân viên trong khi sử dụng GitHub Copilot để tăng tốc công việc, thì "mỗi người đều phải nhận thức được cách mình tiêu thụ token".

Thực ra chuyện này không phải là không có căn cứ. Trong một podcast hồi tháng 6, Nadella đã từng nói rằng tình trạng Tokenmaxxing diễn ra rất nhiều trong nội bộ Microsoft.

Thậm chí, ông còn thừa nhận chính mình cũng là một "Tokenmaxxer", tiêu xài token điên cuồng và cảm thấy rất nghiện khi nhìn vào những con số sử dụng cao ngất ngưởng.

Nhưng với tư cách là sếp, ông vẫn phải tính toán. Thế là ông lại tỉnh táo trở lại: Lợi ích biên từ việc tăng năng suất phải tương xứng với chi phí biên của token.

Không phải vấn đề nào cũng đáng để gọi các mô hình tiên tiến nhất và đắt đỏ nhất. Mô hình chạy lâu hơn, nhồi nhét nhiều ngữ cảnh hơn, hay mở nhiều Agent hơn không đồng nghĩa với việc kết quả cuối cùng sẽ tốt hơn.

Hai tháng sau, nhận định này từ phát biểu trên podcast của CEO đã trở thành chính sách nội bộ của Microsoft.

Tuy nhiên, nhân viên Microsoft lại tỏ ra khá bất mãn. Một nhân viên cho biết:

Một công ty đầu tư mạnh tay vào AI, trợ giá cho lượng lớn suy luận, giờ lại đi hướng dẫn nhân viên của chính mình tiết kiệm tiền??

Sự nghi ngờ của nhân viên này khá sắc bén: Nếu ngay cả công ty cung cấp hạ tầng AI cũng phải lo lắng về việc liệu có đủ khả năng chi trả cho các sản phẩm AI nội bộ hay không, thì các doanh nghiệp bình thường mua những dịch vụ này sẽ phải làm sao?

Tokenmaxxing, mọi người đều không thể "cày" nổi nữa rồi…

Tokenmaxxing thực sự trở nên phổ biến chỉ trong vài tháng gần đây.

token + maxxing (đạt đến mức cực hạn), cũng giống như logic tạo từ trên Internet như gymmaxxing (tập gym điên cuồng), looksmaxxing (cải tạo ngoại hình cực hạn).

Tuy nhiên, nó không mô tả một sự tự hoàn thiện nào đó, mà là một sự khuyến khích méo mó – biến lượng sử dụng AI thành KPI nội bộ của doanh nghiệp.

Tháng 3 năm nay, nhân viên tại các công ty như Meta, OpenAI đã bắt đầu thi đua mức tiêu thụ token trên các bảng xếp hạng nội bộ.

Một số công ty còn coi ngân sách token cao hơn là một phúc lợi cho kỹ sư, hy vọng nhân viên khởi chạy nhiều Agent cùng lúc để giao phó nhiều công việc hơn cho AI.

Đến tháng 5, làn sóng này đã thổi đến Amazon.

Amazon đã tạo ra một bảng xếp hạng nội bộ gọi là KiroRank, chấm điểm dựa trên mức độ sử dụng AI của nhân viên trên nền tảng phát triển AI Kiro của chính họ.

Thực ra, ý định ban đầu của công ty có lẽ là muốn khuyến khích các kỹ sư sử dụng công cụ AI nhiều hơn, dùng càng nhiều thì thứ hạng càng cao.

MicrosoftAITokenGPT-5.6Chi phí AI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.