Thủ thuật
Rakuten ứng dụng Claude Fable 5: Bước tiến mới cho tác nhân AI tự vận hành
(giờ Việt Nam)
Tóm tắt AI
Rakuten đã triển khai thành công Claude Fable 5, cho phép các tác nhân AI tự vận hành xuyên đêm và tự sửa lỗi, giúp tăng tốc độ giải quyết công việc lên gấp 10 lần tại nhiều phòng ban.
Bản dịch AI

Với tư cách là Tổng giám đốc mảng AI cho Doanh nghiệp tại Rakuten, công việc của Yusuke Kaji là “tìm ra những hạt giống của sự đổi mới mang tính chuyển đổi và mở rộng chúng trên toàn công ty.”
Một trong những hạt giống đó chính là Claude.
Kể từ tháng 3 năm 2025, Rakuten đã sử dụng Claude để tăng tốc phát triển phần mềm với Claude Code, thiết lập các tác nhân (agents) trên khắp các bộ phận kinh doanh và cung cấp năng lượng cho các tính năng AI phục vụ hàng triệu khách hàng. Theo Kaji, Rakuten chọn hợp tác với Anthropic vì sự tập trung vào doanh nghiệp, vị thế dẫn đầu và tư duy sản phẩm của họ.
Qua gần một chục lần ra mắt mô hình, ông đã chứng kiến khối lượng công việc mà mình có thể giao cho một tác nhân ngày càng tăng: từ việc sử dụng Claude Code để triển khai phần mềm thực tế, đến việc xây dựng các Claude Managed Agents tùy chỉnh cho các nhóm trong toàn công ty. Ông ví việc thử nghiệm các mô hình mới giống như bắt đầu một “cuộc phiêu lưu mới”.
“Giống như cách một nhà lãnh đạo giỏi chuẩn bị các mục tiêu đầy thử thách cho nhân viên của mình, chúng tôi chuẩn bị các nhiệm vụ đầy thử thách cho một Claude mới,” ông nói thêm. “Có lẽ chính Claude cũng đang thúc đẩy chúng tôi phải nỗ lực hơn nữa.”
Khi thử nghiệm Claude Fable 5, ông biết rằng có điều gì đó khác biệt. Mô hình này có thể tự vận hành trong thời gian dài hơn nhiều so với các phiên bản tiền nhiệm, và lần đầu tiên, nó có thể tự kiểm tra công việc của chính mình và hoàn thành các nhiệm vụ phức tạp qua đêm trong khi Kaji đang ngủ.
Chính sự tự chủ vượt trội đó là điều cho phép Rakuten giao cho các tác nhân của mình những công việc lớn hơn, kéo dài hơn và thay đổi cách thức làm việc của họ.
Xây dựng lực lượng lao động AI-native
Rakuten đang tái cấu trúc chính mình xung quanh AI, một dự án mà họ gọi là AI-nization – nỗ lực toàn công ty nhằm đưa AI vào mọi hoạt động dành cho khách hàng, đối tác kinh doanh và nhân viên. Khi Claude Managed Agents xuất hiện, Rakuten đã triển khai các tác nhân này trên các bộ phận sản phẩm, bán hàng, tiếp thị và tài chính chỉ trong vòng một tuần, tích hợp vào Slack, Microsoft Teams và hệ thống tác vụ riêng của công ty.
Đối với Kaji và đội ngũ của ông, rào cản trong việc xây dựng tác nhân trước đây nằm ở việc ai có thể viết mã; giờ đây, nó nằm ở việc ai hiểu rõ vấn đề kinh doanh.
"Các tập đoàn hiện đại được thiết kế để giảm thiểu chi phí giao tiếp," ông nói. "Tôi tin rằng các tác nhân như Claude Code có thể tỏa sáng khi chúng ta làm việc cùng chúng để giảm thiểu cả chi phí cho sự đổi mới, chẳng hạn như việc chuyển đổi nhanh chóng từ ý tưởng sang sản phẩm thực tế." Hãy trao cho một người có năng lực những tác nhân nắm giữ ngữ cảnh và tư duy thẩm mỹ, và "nó cho phép những tài năng tiềm ẩn khai phá tiềm năng của họ và mở rộng khả năng đó gấp 100 lần."
Tuy nhiên, việc vận hành các tác nhân trong mọi chức năng suốt ngày đêm lại nảy sinh một rào cản mới: sự phán đoán của con người. Mặc dù các tác nhân của Rakuten giải quyết vấn đề nhanh hơn khoảng 10 lần trên mọi lĩnh vực, nhưng số lượng nhiệm vụ mà tổ chức đảm nhận vẫn không ngừng tăng lên. Việc thêm nhiều tác nhân không đồng nghĩa với việc thêm khả năng phán đoán. Vì vậy, các tác nhân vận hành càng nhanh, sự tiến bộ của tổ chức càng phụ thuộc vào việc con người phải là người chốt hạ cuối cùng.
Vận hành các tác nhân chạy trong nhiều giờ mà không cần giám sát
Đối với hầu hết các nhà phát triển, phần khó nhất khi xây dựng các tác nhân chạy dài hạn là thiết lập để chúng thành công với sự giám sát tối thiểu. Kết nối nó với các công cụ và ngữ cảnh phù hợp là một chuyện, nhưng theo kinh nghiệm của Kaji, luôn có những giới hạn về thời gian một tác nhân có thể hoạt động mà không cần con người can thiệp để xác thực công việc.
Trước Claude Fable 5, việc để một tác nhân tự thực hiện một nhiệm vụ kéo dài nhiều giờ mà không có sự giám sát của con người luôn là một canh bạc. "Nếu chúng chọn đúng hướng ngay từ bước đầu tiên, mọi thứ đều ổn," Kaji nói. "Nhưng nếu chúng chọn sai hướng ngay từ đầu, tác nhân sẽ mất rất nhiều thời gian để sửa chữa, hoặc thậm chí không thể đạt được đích đến." Trong một công việc dự kiến chạy năm giờ hoặc cả ngày, một giả định sai lầm ban đầu có thể làm hỏng toàn bộ quá trình, và cách duy nhất để phát hiện ra là có người kiểm tra.
Chế độ thất bại ở đây là thiếu khả năng tự xác thực. Bất kỳ mô hình nào cũng có thể đi sai bước đầu tiên. Vấn đề với các mô hình trước đó là chúng không tự kiểm tra công việc khi đang thực hiện, vì vậy một sai lầm nhỏ ban đầu không bị phát hiện. Nó tích tụ dần trong suốt quá trình và tạo ra kết quả không tối ưu sau nhiều giờ.
Theo Kaji, Claude Fable 5 thay đổi cách tính toán cho các tác nhân chạy trong nhiều ngày vì nó tự kiểm tra công việc của chính mình trong khi thực hiện, thường xuyên hơn nhiều so với bất kỳ mô hình nào trước đây.
"Chúng tôi đã thử nghiệm Fable và chúng tôi yêu thích khả năng tự phản tư và tự xác thực của nó," Kaji nói. "So với các mô hình trước đây, nó hiểu sai lầm của mình trước khi tôi chỉ ra vào lúc 2 giờ hoặc 3 giờ sáng—nhờ đó tôi có thể ngủ ngon."
Điều gì tạo nên sự khác biệt cho Claude Fable 5
Đội ngũ của Kaji liệt kê ba hành vi giúp phân biệt Claude Fable 5 với các phiên bản tiền nhiệm và báo hiệu một bước tiến vượt bậc trong trí tuệ tiên phong:
Quan trọng nhất, sự tự chủ lâu dài hơn làm thay đổi đơn vị công việc mà Kaji có thể ủy quyền.
“Trước Fable, chúng tôi phải chia nhỏ công việc thành các phần rõ ràng để tác nhân thực hiện,” ông nói. Giờ đây, ông có thể giao toàn bộ một nhiệm vụ và chạy nhiều nhiệm vụ cùng một lúc.
Claude Fable 5 thay đổi những gì diễn ra ở giữa quá trình. Nó phản tư ở từng bước, phát hiện ra một giả định sai lầm từ sớm và tự tìm đường quay lại các nguyên tắc cơ bản — điều hướng lại để đạt được kết quả đúng mà không cần ai dẫn dắt. Vì mô hình tự sửa lỗi ngay trong quá trình vận hành, việc phê duyệt trở nên khả thi lần đầu tiên, và đơn vị công việc mà Kaji ủy quyền chuyển từ nhiệm vụ sang quyết định. Các tác nhân cũng lưu giữ bộ nhớ giữa các lần chạy: "Các tác nhân có bộ nhớ của chúng tôi ghi nhớ những gì đã sai trong các phiên trước và tránh lặp lại những sai lầm đó."
Kết quả là, số lượng nhiệm vụ tuyệt đối liên tục tăng, nhưng những nhiệm vụ thực sự cần con người vẫn nằm trong tầm kiểm soát. Ông cho biết, việc không phải can thiệp và điều hướng giữa chừng chính là thành quả năng suất lớn nhất—nó cho phép đội ngũ của ông dành thời gian cho những quyết định mà chỉ con người mới nên thực hiện, đồng thời giữ cho một tổ chức AI-native luôn tăng tốc thay vì bị đình trệ do phải sửa sai thủ công.
Cân bằng giữa chi phí và hiệu quả
Khả năng tiên phong đi kèm với mức giá tiên phong, và Kaji thẳng thắn thừa nhận rằng chi phí quyết định quy mô triển khai của ông.
"Là một doanh nghiệp lớn, chúng tôi muốn cân bằng giữa trí tuệ và chi phí," ông nói. Đội ngũ của ông đo lường tỷ lệ hoàn thành nhiệm vụ cùng với chi phí trên mỗi nhiệm vụ, sau đó gửi những công việc mà khả năng vượt trội của Fable 5 có thể thay đổi kết quả cho nó, và để các mô hình nhỏ hơn xử lý phần còn lại.
Đối với Kaji, hai điều giúp bài toán kinh tế nghiêng về phía Fable 5: nó hoàn thành nhiều việc hơn với ít token hơn và ít sai lầm hơn, đồng thời cần ít sự hỗ trợ thủ công hơn.
Điều gì tiếp theo
Biên giới mà Kaji đang thử nghiệm hiện nay không phải là tốc độ cá nhân. Đó là việc khiến các tác nhân điều phối con người. Claude Code đã tăng tốc công việc của chính ông và các đồng nghiệp, nhưng phần khó nhất của bất kỳ tổ chức nào là sự đồng bộ giữa con người, việc kết nối ngữ cảnh và tư duy của người này với người khác. Ông đang khám phá các tác nhân có khả năng "điều phối hoặc tổ chức, giống như một người quản lý hơn," nắm giữ những sắc thái thường bị mất đi giữa các thành viên trong nhóm.
"Chúng tôi không coi các tác nhân AI là đồng nghiệp hay đối thủ trong tương lai. Chúng là những hệ thống xung quanh chúng ta." Và ông tuân thủ lời khuyên của chính Anthropic, rằng bạn nên xây dựng cho mô hình sẽ ra mắt trong ba hoặc sáu tháng tới thay vì mô hình đang ở trước mắt bạn.
"Tôi nghĩ rằng với tư cách là một xã hội, chúng ta vẫn chưa tìm ra sự phù hợp giữa mô hình và nhiệm vụ cho Claude Fable 5," ông nói, "nhưng nó đã nổi bật như một mô hình vượt qua ranh giới và bước vào thế giới của chúng ta."
Bắt đầu với Claude Fable 5.
Bài viết được AI dịch và tổng hợp tự động từ Claude: Blog (Web). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.