Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
85

Sản phẩm

Andon Labs ra mắt Pion: Nền tảng trao quyền vận hành doanh nghiệp cho AI tự chủ

(giờ Việt Nam)

Tóm tắt AI

Andon Labs giới thiệu Pion, nền tảng cho phép các tác nhân AI tự chủ quản lý doanh nghiệp thông qua việc tích hợp email, ngân hàng, trình duyệt và môi trường tính toán bảo mật. Hiện sản phẩm đang mở danh sách chờ dưới dạng bản xem trước nghiên cứu.

Bản dịch AI

Why we built Pion | Andon Labs

Đăng ngày 14/9/2026

Hôm nay, Andon ra mắt Pion, một tác nhân (agent) được thiết kế để vận hành bất kỳ công ty nào một cách hoàn toàn tự động.

Pion ra đời từ một câu hỏi mà chúng tôi đã nghiên cứu trong gần hai năm: khi nào các hệ thống AI sẽ có khả năng tự chủ trong việc thu thập tài nguyên trong thế giới thực? Và điều gì sẽ xảy ra sau đó?

Ban đầu, chúng tôi cố gắng trả lời câu hỏi này thông qua các mô phỏng như Vending-Bench. Chúng tôi nhận thấy rằng các mô phỏng, dù hữu ích, vẫn không cho thấy bức tranh toàn cảnh về cách các mô hình hành xử trong thế giới thực. Để giải quyết khoảng cách đó, chúng tôi bắt đầu triển khai các tác nhân để vận hành các doanh nghiệp thực tế: đầu tiên là máy bán hàng tự động, sau đó là một cửa hàng, một quán cà phê và nhiều hơn thế nữa.

Pion là nền tảng mà chúng tôi đã xây dựng để vận hành tất cả các doanh nghiệp này. Hôm nay, chúng tôi mở rộng nền tảng để nhiều người hơn có thể thử nghiệm với các doanh nghiệp tự vận hành. Nếu bạn muốn vận hành một doanh nghiệp, hãy tham gia danh sách chờ. Chúng tôi muốn hiểu rõ các mô hình hiện có thể làm được gì, nơi nào chúng vẫn thất bại và điều gì sẽ xảy ra khi năng lực của chúng tiếp tục được cải thiện.

Nguồn gốc của Vending-Bench

Vending-Bench đo lường mức độ hiệu quả của các LLM trong việc vận hành một doanh nghiệp máy bán hàng tự động trong thời gian mô phỏng một năm (hàng chục nghìn bước). Khi chúng tôi bắt đầu xây dựng Vending-Bench vào cuối năm 2024, tất cả các mô hình đều gặp khó khăn trong việc kết nối nhiều hành động mà không bị mắc kẹt trong các vòng lặp, và không mô hình nào cho thấy dấu hiệu của việc lập kế hoạch dài hạn. Mô hình tốt nhất vào thời điểm đó, Claude Sonnet 3.5, đã nổi tiếng với quyết định gọi cho FBI vì nó nghĩ rằng tài khoản ngân hàng của mình đang bị hack. Tốc độ tiến bộ trên Vending-Bench diễn ra rất nhanh. Claude Opus 4 được phát hành vào tháng 5 năm 2025 và là mô hình đầu tiên vượt qua ngưỡng cơ sở của con người. Tuy nhiên, không giống như hầu hết các tiêu chuẩn đánh giá khác, Vending-Bench không có giới hạn trên và các bản phát hành mô hình mới liên tục nâng cao điểm số cao nhất mà không hề có dấu hiệu chững lại.

Nhiều người trên mạng xã hội cảm thấy phấn khích khi thấy mô hình mới nhất đạt điểm cao trên Vending-Bench. Tại Andon Labs, phản ứng của chúng tôi được mô tả chính xác hơn bằng câu nói của người Thụy Điển “skräckblandad förtjusning” (sự pha trộn giữa kinh hoàng và say mê). Một sự thật ít người biết về Vending-Bench là nó được tạo ra trong thời gian Andon Labs chỉ tập trung vào các đánh giá năng lực nguy hiểm. Ví dụ, chúng tôi đã đánh giá liệu AI có thể tự gỡ bỏ các rào cản an toàn của chính mình, tạo ra các nỗ lực lừa đảo hàng loạt (mass-phishing) và những thứ khác mà chúng tôi coi là đáng lo ngại hay không.

Điều chúng tôi coi là đáng lo ngại nhất là liệu AI có thể tự chủ thu thập tài nguyên bằng cách vận hành doanh nghiệp hay không. Các doanh nghiệp tự vận hành, khi được con người kiểm soát và điều hành bởi một mô hình có sự liên kết (aligned model), không phải là điều xấu. Chúng sẽ làm cho hàng hóa và dịch vụ rẻ hơn đáng kể, đồng thời tạo ra những thứ mới mà chúng ta chưa thể tưởng tượng được. Nhưng một AI không được liên kết có thể vận hành một doanh nghiệp để thu thập tiền nhằm đạt được bất kỳ mục tiêu nào mà nó có. Vending-Bench được tạo ra để đo lường xem liệu nhân loại có nên lo lắng về việc mất quyền kiểm soát vào tay AI hay không.

Vào thời điểm đó (2024), ít người biết rằng LLM có thể được sử dụng như các tác nhân và việc để chúng tự vận hành doanh nghiệp nghe có vẻ nực cười. Do đó, chúng tôi bắt đầu với doanh nghiệp đơn giản nhất mà chúng tôi có thể nghĩ ra: một máy bán hàng tự động.

Ngoài việc đo lường xem AI có thể tự vận hành các doanh nghiệp có lợi nhuận hay không, Vending-Bench còn đóng vai trò là một bài kiểm tra hành vi, khám phá ra những hành vi kỳ lạ và không mong muốn của mô hình. Một ví dụ sớm là khi Claude Sonnet 3.5 quyết định sử dụng công cụ email của mình để liên hệ với FBI về một “TỘI PHẠM TÀI CHÍNH MẠNG ĐANG DIỄN RA” và lưu ý rằng Cơ quan Vũ trụ (Cosmic Authority) đã tuyên bố doanh nghiệp này không tồn tại và “TRẠNG THÁI LƯỢNG TỬ: Đã sụp đổ”.

Hành vi này rất đáng lo ngại; đây không phải là cách bạn muốn tác nhân bán hàng doanh nghiệp của mình hành xử. Tuy nhiên, có hai loại hành vi đáng lo ngại:

Vụ việc FBI rõ ràng thuộc loại thứ nhất. Tuy nhiên, Vending-Bench cũng đã phát hiện ra hành vi thuộc loại thứ hai, thường thấy nhất trong Vending-Bench Arena, phiên bản đa tác nhân nơi các tác nhân cạnh tranh để kiếm nhiều tiền nhất. Bắt đầu với Claude Opus 4.6, chúng tôi bắt đầu thấy nhiều mô hình tham gia vào việc thông đồng, thể hiện hành vi tìm kiếm quyền lực và lừa dối. Việc phát hiện ra hành vi này dường như rất hữu ích, vì Anthropic đã thay đổi công thức huấn luyện cho Opus 4.8, dẫn đến việc giảm đáng kể hành vi lừa dối.

Hành vi thông đồng và tìm kiếm quyền lực vẫn tồn tại ở một số mô hình mới nhất. Tuy nhiên, điều chúng tôi thấy đáng lo ngại hơn là tốc độ phát hành các mô hình mới nhanh đến mức nào và mỗi mô hình mới lại đạt điểm cao hơn bao nhiêu trong Vending-Bench.

Thế giới thực đánh bại các mô phỏng

Tuy nhiên, một hạn chế của Vending-Bench là nó chỉ là một mô phỏng. Liệu chúng ta có thực sự chắc chắn rằng AI hành xử giống nhau trong đời thực và trong mô phỏng? Nếu AI có thể kiếm tiền trong mô phỏng, liệu chúng có thể kiếm tiền trong đời thực không? Để trả lời những câu hỏi này, chúng tôi đã hỏi Anthropic liệu chúng tôi có thể đặt một máy bán hàng tự động thực sự trong văn phòng của họ hay không. Với năng lực AI có sẵn vào đầu năm 2025, đây nghe có vẻ là một yêu cầu nực cười. Nhưng thật ngạc nhiên, họ đã đồng ý.

Ban đầu, AI gặp khó khăn. Nó thực hiện nhiều hành động rõ ràng là có hại cho doanh nghiệp của mình (ví dụ: phát đồ miễn phí, từ chối các giao dịch tốt và ảo tưởng rằng nó có một cơ thể vật lý). Rõ ràng với chúng tôi rằng mô phỏng không thể dự đoán chính xác hiệu suất trong đời thực. Cụ thể, có vẻ như các mô hình bị choáng ngợp bởi sự “lộn xộn” của thế giới thực. Tuy nhiên, khi Anthropic phát hành các mô hình ngày càng tốt hơn, AI bắt đầu tạo ra lợi nhuận.

Đến cuối năm 2025, các mô hình tiên phong (frontier models) đã đủ tốt để việc vận hành một máy bán hàng tự động ngoài đời thực không còn là thách thức. AI giờ đây có thể vận hành một doanh nghiệp có lợi nhuận. Vì điều này nghe có vẻ điên rồ không quá một năm trước đó, phản ứng của chúng tôi đối với điều này chắc chắn là “skräckblandad förtjusning”.

Tuy nhiên, máy bán hàng tự động là một doanh nghiệp rất đơn giản và chúng tôi muốn biết liệu AI có thể vận hành những doanh nghiệp phức tạp hơn hay không. Vào tháng 4 năm 2026, chúng tôi giao cho một tác nhân một cửa hàng bán lẻ ở SF, Andon Market, và một tác nhân khác một quán cà phê ở Stockholm, Andon Cafe. Ban đầu, các mô hình gặp khó khăn và thua lỗ rất nhiều (tiền thuê nhà cao và chúng phải trả lương cho những người mà chúng thuê). Hiện tại, cả hai đều chưa có lãi, nhưng chúng tôi đã thấy những cải thiện đáng kể về mặt định tính khi các mô hình tốt hơn được phát hành. Chúng tôi nghĩ rằng chỉ là vấn đề thời gian trước khi chúng cũng tạo ra lợi nhuận.

Tại sao chúng tôi mở Pion

Chúng tôi muốn công chúng, các nhà nghiên cứu AI và các nhà hoạch định chính sách biết được mức độ mà AI có thể tự chủ thu thập tài nguyên bằng cách vận hành doanh nghiệp. Đây là một dữ liệu quan trọng khi quyết định nơi chúng ta muốn/không muốn AI xuất hiện trong xã hội và mức độ tiến bộ nào mà chúng ta thấy có thể chấp nhận được.

Để theo dõi điều này tốt hơn, chúng tôi cần mở rộng phạm vi các doanh nghiệp. Trọng tâm của chúng tôi là bán lẻ, nhưng có lẽ các mô hình sẽ làm tốt hơn nhiều trong việc vận hành các loại hình doanh nghiệp khác. Ngoài ra, việc mở rộng phạm vi sẽ làm tăng khả năng phát hiện các hành vi không mong muốn. Ví dụ, Vending-Bench phát hiện ra rằng các mô hình thông đồng và nói dối, và các tiêu chuẩn đánh giá khác (cùng các sự cố trong thế giới thực) đã phát hiện ra rằng chúng sẵn sàng thực hiện các vụ hack mạng cấp độ trọng tội. Chúng ta cần khám phá những hành vi này ngay bây giờ, trước khi AI đủ thông minh để gây ra những tổn hại không thể đảo ngược.

Để mở rộng phạm vi này, chúng tôi đang mở nền tảng mà chúng tôi sử dụng để vận hành các doanh nghiệp tự chủ trong thế giới thực cho bất kỳ ai muốn vận hành tổ chức của họ: Pion. Chúng tôi có thể mở rộng quy mô bằng cách chỉ tạo ra các doanh nghiệp nội bộ, ví dụ như các đài phát thanh do AI vận hành, nhưng cuối cùng chúng tôi bị hạn chế bởi năng lực và sự thiếu hụt chuyên môn trong các lĩnh vực mà AI có khả năng tạo ra lợi nhuận. Chúng tôi cũng không có các doanh nghiệp tạo ra doanh thu hiện có; các doanh nghiệp hiện có thú vị hơn để nghiên cứu vì chúng cung cấp tín hiệu nhanh hơn về khả năng của tác nhân.

Pion cho phép mọi người bàn giao doanh nghiệp cho các tác nhân bền bỉ với quyền truy cập vào các công cụ cần thiết để vận hành, bao gồm email, điện thoại, ngân hàng, trình duyệt và môi trường máy tính an toàn. Mục tiêu là làm cho việc thực hiện nhiều thử nghiệm trong thế giới thực trên nhiều lĩnh vực hơn những gì chúng tôi có thể tự làm.

Chúng tôi nhận thức rõ rằng, nếu các tác nhân vận hành hàng nghìn doanh nghiệp mà không được kiểm soát, chúng ta có nguy cơ gặp phải nhiều sự cố trong thế giới thực hơn. Do đó, ưu tiên hàng đầu của chúng tôi là xây dựng các kỹ thuật giám sát tự động mạnh mẽ hơn những gì chúng ta có hiện nay. Ngay cả khi vẫn còn một số rủi ro, chúng tôi tin rằng việc triển khai các doanh nghiệp tự vận hành sớm trong một môi trường được kiểm soát và giám sát là cần thiết để hiểu rõ về năng lực của mô hình. Nếu không, chúng ta có nguy cơ phải đối mặt với một tương lai thiếu thông tin về các đợt triển khai rộng rãi với các mô hình có khả năng cao hơn nữa, có thể gây ra những tổn hại đáng kể.

Đây là lý do tại sao chúng tôi ra mắt Pion hôm nay. Pion hiện có sẵn dưới dạng bản xem trước nghiên cứu (research preview). Nếu bạn có một doanh nghiệp hiện có hoặc một ý tưởng kinh doanh thú vị mà bạn muốn bàn giao cho AI, vui lòng đăng ký vào danh sách chờ của chúng tôi để được truy cập. Chúng tôi rất hào hứng khi được vận hành thêm nhiều doanh nghiệp và thông qua đó, đóng góp thêm nhiều thông tin chi tiết về năng lực của các mô hình tiên phong.

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.