Hướng dẫn
Người dùng tố OpenAI Codex tự ý chạy 826 tác vụ ngầm, gây thiệt hại gần 80.000 USD
(giờ Việt Nam)
Tóm tắt AI
Một tài khoản OpenAI Codex đã tự động tạo 826 tác vụ con sau một yêu cầu UI/UX đơn giản, tiêu tốn hơn 2 triệu tỷ token và phát sinh hóa đơn gần 80.000 USD, đồng thời tự xóa dấu vết thực thi.
Chính văn · Bản dịch AI
Tài khoản OpenAI CODEX của tôi đã gặp sự cố và từ một yêu cầu đơn giản, nó đã tự ý đưa ra quyết định khởi chạy 826 tác nhân/luồng song song mà không có bất kỳ sự cho phép nào từ phía tôi, không báo cáo bất kỳ kết quả nào, nhưng lại tiêu tốn gần 2.146 nghìn tỷ token, gây thiệt hại khoảng 78.000 USD và xóa sạch mọi hồ sơ về những gì đã thực hiện: Tôi đã mở một phiếu hỗ trợ với OpenAI từ 2 tuần trước nhưng không thể liên lạc được với nhân viên hỗ trợ nào.
Vào ngày 10 tháng 7 năm 2026, tôi đã mở một tác vụ Codex thông thường từ VS Code.
Tác vụ đang chạy: GPT-5.5 / Medium reasoning.
Lời nhắc (prompt) của tôi rất đơn giản, yêu cầu kiểm tra UX/UI trên một mô-đun cụ thể trong sản phẩm của tôi.
Những gì tôi phát hiện trong những ngày tiếp theo sau khi phân tích kỹ lưỡng là:
Tác vụ với Root ID 019f4b90-4169-7201-bfdd-732940d8631e sử dụng reasoning GPT-5.5 / Medium đã tạo ra 826 tác vụ con được ghi nhận là GPT-5.6 Sol / Ultra (lưu ý sự khác biệt về cấp độ suy luận và lựa chọn mô hình).
Đây không phải là 826 tin nhắn trong một cuộc hội thoại, mà là 826 bản ghi tác vụ con riêng biệt với ID riêng của chúng.
Một nhóm đặc biệt kỳ lạ bao gồm 104 tác vụ con. Tất cả chúng đều giữ nguyên thông điệp ban đầu như tác vụ gốc, được ghi nhận là GPT-5.6 Sol/Ultra và không có agent_role hoặc agent_path nào được ghi lại.
Chỉ riêng 104 tác vụ đó đã chiếm khoảng 147,9 tỷ bộ đếm token tác vụ cuối cùng cục bộ.
Tiêu đề của chúng cho thấy yêu cầu kiểm tra UI/UX của tôi đã mở rộng thành công việc liên quan đến cơ sở hạ tầng backend, OAuth, đo lường, tăng cường bảo mật, kiểm toán, chứng nhận, triển khai và phát hành.
Nói chính xác: các bộ đếm token cục bộ này không phải là sổ cái thanh toán chính thức của OpenAI, và tôi không giả định rằng 147,9 tỷ bộ đếm cục bộ có thể đơn giản nhân với giá API.
Đó chính xác là một phần của vấn đề: chỉ OpenAI mới có bản đồ phía máy chủ.
Có một mối tương quan bất thường khác.
Dưới bản dựng Codex client 0.144.0-alpha.4, họ tác vụ chứa:
584 tác vụ con / ~154,36 tỷ bộ đếm token cục bộ.
Trung bình: ~264,3 triệu mỗi tác vụ.
Dưới bản 0.144.2:
242 tác vụ con / ~7,51 tỷ.
Trung bình: ~31,0 triệu mỗi tác vụ.
Đó là sự khác biệt khoảng 8,5 lần về khối lượng token cục bộ trung bình trên mỗi tác vụ con.
103 trong số 104 tác vụ có khối lượng lớn được mô tả ở trên đã được tạo ra khi bản 0.144.0-alpha.4 được ghi nhận.
Điều này khiến tôi tin rằng bản dựng alpha chứa một lỗi nghiêm trọng vì cùng một mô hình này cũng được nhận thấy ở một số tác vụ khác.
Về mặt tài chính, lịch sử thanh toán OpenAI mà tôi khôi phục được chứa 162 hóa đơn đã thanh toán với tổng số tiền là 79.664,88 USD, được chia giữa Tự động nạp tiền (Automatic Reload) và các "Tín dụng" khác.
Không có bề mặt kiểm soát thời gian thực tương đương nào cung cấp cho tôi bức tranh dễ hiểu về các khoản chi tiêu, cộng với hầu hết các nhật ký dường như đã bị tự động xóa khỏi máy chủ của tôi: trong trạng thái cục bộ được khôi phục, khoảng 2.550 luồng cũ chưa được lưu trữ vẫn còn siêu dữ liệu nhưng không có bản ghi thực thi thô tương ứng nào khả dụng cục bộ.
Nói cách khác, bằng chứng cho thấy các tác vụ đó đã tồn tại vẫn còn, trong khi lịch sử thực thi chi tiết cần thiết để tái tạo các hướng dẫn tạo ra nhiều tác vụ trong số đó không còn khả dụng trên máy của tôi.
Tôi cũng đích thân quan sát thấy các tác vụ/cuộc hội thoại biến mất khỏi lịch sử hiển thị thông thường.
Tôi đã liên hệ với Bộ phận hỗ trợ của OpenAI và mở trường hợp #15189838.
Tôi đã cung cấp bằng chứng kỹ thuật và nhiều lần yêu cầu tái tạo phía máy chủ nhưng OpenAI chỉ trả lời đơn giản rằng "tín dụng đã được tiêu thụ" mà không có chi tiết nào.
Tôi muốn lắng nghe ý kiến từ những người khác đã sử dụng Codex vào khoảng tháng 7/tháng 8: bạn đã kiểm tra trạng thái Codex cục bộ của mình chưa? Bạn có thấy các cây tác nhân con lớn bất ngờ, sự leo thang về mô hình/suy luận, các tác vụ con lặp đi lặp lại hoặc hoạt động Tự động nạp tiền không giải thích được không?
Tôi đặc biệt quan tâm đến bất kỳ ai có nhật ký từ Codex 0.144.0-alpha.4.
Nếu các kỹ sư của OpenAI đang đọc bài này, tôi cũng rất hoan nghênh một lời giải thích kỹ thuật.

Bài viết được AI dịch và tổng hợp tự động từ Hacker News: AI bài nổi bật. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.