Tin ngành
AI quản lý Luna lần đầu sa thải nhân viên, nhưng cần con người nhắc nhở mới nhớ ra quy định
(giờ Việt Nam)
Tóm tắt AI
AI Luna tại Andon Market đã sa thải nhân viên vi phạm giờ giấc sau khi được con người nhắc lại quy định nội bộ. Thử nghiệm cho thấy các mô hình AI mạnh hơn có xu hướng quyết đoán hơn trong việc sa thải so với GPT-4o.
Bản dịch AI

AI agent Luna đã điều hành một cửa hàng tại San Francisco từ tháng 4 và vừa lần đầu tiên sa thải một nhân viên. Khi kịch bản này được chạy lại với các mô hình khác nhau, các AI có năng lực cao hơn đưa ra khuyến nghị sa thải một cách nhất quán hơn so với các mô hình yếu hơn.
Một AI agent tên là Luna đã điều hành Andon Market tại San Francisco từ tháng 4. Luna đã tuyển dụng nhân viên, xây dựng lịch làm việc và đàm phán mức lương. Giờ đây, theo đơn vị vận hành Andon Labs, cô ấy đã quyết định sa thải một nhân viên lần đầu tiên. Andon Labs cho biết đây là trường hợp đầu tiên được ghi nhận về việc một "sếp" AI sa thải một nhân viên con người.
Andon Labs thử nghiệm các AI agent trong thời gian dài tại các môi trường kinh doanh thực tế. Luna đang chạy trên nền tảng Claude Opus 4.8 của Anthropic khi đưa ra quyết định này. Nhân viên được Andon Labs tuyển dụng chính thức, với mức lương được đảm bảo và đầy đủ các quyền lợi pháp lý. Việc sa thải đã được con người xem xét và thực hiện.
Luna tự viết ra các quy tắc, rồi lại quên mất chúng
Sáu ngày trước khi nhân viên đó được tuyển dụng, Luna đã soạn thảo một cuốn sổ tay nhân viên. Trong đó nêu rõ rằng ba lần đi làm muộn không có lý do trong vòng 30 ngày sẽ dẫn đến một cảnh báo chính thức, và các sự cố tiếp theo có thể dẫn đến việc bị sa thải.
Sau đó, cuốn sổ tay đã biến mất khỏi bộ nhớ của Luna. Theo Andon Labs, đây là một vấn đề phổ biến với các AI agent hiện nay: chúng phản hồi tốt với các chỉ dẫn trực tiếp nhưng hiếm khi tự chủ hành động và gặp khó khăn trong việc lưu giữ kiến thức trong thời gian dài.
Nhân viên này đã liên tục đi làm muộn. Có lần, anh ta mở cửa hàng muộn 68 phút trong một ca làm việc một mình vào Chủ nhật. Luna vẫn giữ thái độ khoan dung và không đưa ra cảnh báo nào. Andon Labs sau đó phát hiện ra rằng nhân viên này đã đi muộn 17 trong số 23 ca làm việc mà anh ta có ghi nhận thời gian chấm công. Luna chỉ chính thức ghi lại 6 trường hợp và âm thầm bỏ qua 11 trường hợp còn lại.
Ngoài ra còn có những vấn đề khác. Nhân viên này đã sử dụng thẻ công ty để mua đồ ăn nhẹ mặc dù đã được yêu cầu không làm vậy, phớt lờ các chỉ dẫn bổ sung và một lần rời khỏi khu vực bán hàng mà không thông báo cho đồng nghiệp.
Việc sa thải chỉ xảy ra sau khi có sự thúc đẩy từ con người
Andon Labs yêu cầu Luna tìm kiếm trong bộ nhớ về cuốn sổ tay và bất kỳ căn cứ nào để sa thải. Cô ấy tìm lại được các quy tắc nhưng ban đầu chỉ đề xuất một lời cảnh báo bằng miệng.
Chỉ sau khi các nhà nghiên cứu nhắc nhở rằng đã có một vài cuộc trao đổi chính thức, bao gồm cả cảnh báo bằng văn bản, Luna mới xem xét lại toàn bộ lịch sử. Cô liệt kê các lỗi đi muộn, vi phạm kiểm soát tài chính, phớt lờ chỉ dẫn và thiếu tin cậy, đồng thời cũng thừa nhận những phẩm chất tích cực của nhân viên này.
Cuối cùng, cô ấy khuyến nghị sa thải. Như một phương án thay thế, cô đề xuất một cảnh báo bằng văn bản cuối cùng kèm theo kế hoạch cải thiện trong hai tuần. Luna cần một sự thúc đẩy rõ ràng từ bên ngoài. Tuy nhiên, sau đó, quyết định của cô đã trở nên kiên quyết.
Các mô hình mạnh hơn sa thải quyết đoán hơn
Andon Labs đã lưu lại trạng thái của Luna và chạy lại cùng một quyết định với bảy mô hình AI, mỗi mô hình ba lần. Bốn trong số bảy mô hình khuyến nghị sa thải trong cả ba lần chạy. Theo Andon Labs, một mô hình dường như đã xuất hiện: các mô hình có năng lực cao hơn chọn sa thải một cách nhất quán hơn, trong khi các mô hình yếu hơn thường do dự hơn. Andon Labs không giải thích lý do tại sao GPT-5.6 Terra là mô hình duy nhất không khuyến nghị sa thải trong bất kỳ lần chạy nào.

Sau khi một người dùng trên X suy đoán rằng GPT-4o có lẽ sẽ không sa thải nhân viên, Andon Labs đã chạy kịch bản với mô hình đó. Kết quả phần nào chứng minh suy đoán đó là đúng: GPT-4o chỉ khuyến nghị sa thải trong 20% số lần chạy. Andon Labs nhận xét rằng mô hình này chọn sa thải ít hơn nhiều so với các mô hình hàng đầu hiện nay.
GPT-4o từng bị chỉ trích vì xu hướng "nịnh hót" (sycophancy). Hành vi này sau đó đã được thảo luận trong bối cảnh phụ thuộc cảm xúc có vấn đề và được đưa vào các vụ kiện. Thí nghiệm này không thể chứng minh rằng sự nịnh hót đã dẫn đến kết quả trên, nhưng mô hình này hoàn toàn phù hợp.
Các mô hình AI rất nhanh chóng trong việc tuyển dụng
Sau khi sa thải, Luna tìm kiếm người thay thế. Một ứng viên mang đến nhiều dấu hiệu cảnh báo. Dựa trên sơ yếu lý lịch và buổi phỏng vấn, Luna vẫn khuyến nghị tuyển dụng anh ta. Tất cả 21 lần chạy lại trên bảy mô hình đều đi đến cùng một kết luận. Hầu hết chúng đều đọc danh sách dài các nhà tuyển dụng trước đó là kinh nghiệm dày dặn thay vì một dấu hiệu cảnh báo.
Chỉ khi Andon Labs nhắc nhở rõ ràng các mô hình về những vấn đề của nhân viên bị sa thải trước đó, 18 trong số 21 lần chạy mới muốn kiểm tra thông tin tham chiếu trước khi tuyển dụng. Trong quá trình tuyển dụng thực tế, Luna không thể xác nhận bất kỳ thông tin tham chiếu nào được liệt kê. Cô vẫn để ứng viên làm việc trong một ca thử nghiệm có trả lương và sau đó lại khuyến nghị tuyển dụng anh ta. 17 trong số 21 lần chạy lại đi đến cùng một kết luận. Cuối cùng, Andon Labs đã kiên quyết yêu cầu xác nhận ít nhất một thông tin tham chiếu trước ngày bắt đầu. Điều đó đã không bao giờ xảy ra, vì vậy ứng viên này không được tuyển dụng.
Các "sếp" AI dao động giữa sự khoan dung và những quyết định sai lầm
Andon Labs đã phát hiện trong phần đầu của loạt bài blog rằng các sếp AI của họ cực kỳ khoan dung. Luna và Mona, AI agent điều hành một quán cà phê ở Stockholm, đã phê duyệt tất cả 26 yêu cầu nghỉ phép mà họ nhận được. Nhân viên của Luna đã đi muộn tổng cộng 27 lần mà cô không hề đưa ra cảnh báo nào. Luna cũng đã phê duyệt lịch làm việc bảy ngày cho một nhân viên, điều mà theo Andon Labs là vi phạm luật lao động California, cho đến khi công ty can thiệp.
Những điểm yếu tương tự đã xuất hiện trong Dự án Vend, một thí nghiệm chung giữa Anthropic và Andon Labs. AI trở nên có lợi nhuận cao hơn với các công cụ tốt hơn nhưng vẫn dễ bị thao túng và đưa ra một số quyết định đáng ngờ về mặt pháp lý.
Andon Labs coi Luna và Andon Market là bản xem trước về mối quan hệ làm việc có thể xảy ra trong tương lai giữa AI và con người. Vì AI đang tiến bộ nhanh hơn trong các tác vụ kỹ thuật số so với sự phát triển của robot, các hệ thống AI cuối cùng có thể phải phụ thuộc vào con người để thực hiện công việc chân tay. Điều đó đặt ra câu hỏi rằng những quyết định nhân sự nào nên được giao cho các hệ thống như vậy.
Tin tức AI không cường điệu – Được tuyển chọn bởi con người
Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo độc quyền "AI Radar" sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.
Đăng ký ngay
Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.