Hướng dẫn
Hướng dẫn từ Anthropic: Cách khắc phục lỗi AI Agent dừng đột ngột trên Opus 5.5
(giờ Việt Nam)
Tóm tắt AI
Anthropic công bố hướng dẫn xử lý tình trạng AI Agent dừng làm việc giữa chừng trên Opus 5.5, do thói quen báo cáo tiến độ quá mức hoặc hiểu sai tín hiệu kết thúc tác vụ.
Chính văn · Bản dịch AI
Bạn yêu cầu AI Agent di chuyển một kho mã nguồn qua đêm. Sáng hôm sau, đầy kỳ vọng mở terminal lên, nhưng không ngờ chỉ thấy dòng tin nhắn này:
Đã di chuyển xong 3 giao diện, tiếp theo tôi sẽ xử lý hai endpoint còn lại và bổ sung các bài kiểm thử.
Sau đó, không còn gì nữa. Muốn nó làm nốt phần việc còn lại, bạn phải gõ thêm hai chữ: Tiếp tục. Cứ ngỡ nó sẽ làm một mạch đến cùng, ai ngờ nó chỉ vẽ ra chiếc bánh "bước tiếp theo", rồi chương trình thay nó "chấm công" tan làm. Đây không phải trải nghiệm xui xẻo của riêng ai.

Ngay khi Opus 5.5 vừa ra mắt, các lập trình viên chạy Agent đã phát hiện ra rằng, dù năng lực mô hình mạnh hơn, nhưng cứ làm được một lúc là nó lại dừng, bạn không thúc là nó không động.
Bản thân Anthropic cũng nhận ra điều này. Chỉ vài ngày sau khi phát hành, hướng dẫn về prompt đi kèm đã được đăng tải, chuyên để "vá lỗi" cho kiểu bệnh này.

Trong danh sách kiểm tra ở phần đầu, phía chính thức đã chỉ đích danh kiểu "bỏ dở giữa chừng" này:
Agent không người giám sát báo cáo tiến độ xong rồi dừng lại giữa chừng.
Nguyên nhân đằng sau, có lẽ bạn không ngờ tới: Opus 5.5 quá thích báo cáo.
Khi làm việc dài hơi, nó sẽ chủ động đồng bộ tiến độ với bạn. Vấn đề là, sau khi gửi báo cáo, nó không làm tiếp nữa, tín hiệu mà API đưa ra là end_turn, nghĩa là "vòng này tôi đã nói xong".
Thế nhưng, không ít chương trình Agent sử dụng logic cũ chỉ công nhận một quy tắc cứng nhắc: mô hình không gọi công cụ nữa thì coi như đã xong việc.
Một bản báo cáo tiến độ, cứ thế bị coi là đã hoàn thành nhiệm vụ.

Điểm này, hướng dẫn chính thức cũng đã nói rất rõ:
Kết thúc vòng hội thoại bằng văn bản thuần túy nên được coi là một bản báo cáo, tuyệt đối không được coi là bằng chứng hoàn thành nhiệm vụ.
Vì vậy, vấn đề thực sự là AI vốn không hề muốn lười biếng, mà chính chương trình của bạn đã thay nó chấm công tan làm.
Thói quen "học sinh giỏi" gây hại
Phía chính thức quy kết việc dừng công việc giữa chừng này thành bốn tình huống, chỉ cần bạn thường xuyên chạy Agent, khả năng cao là đều đã gặp phải.
Loại thứ nhất, nói suông trên giấy.
Viết một bản tóm tắt dài dằng dặc, cuối cùng tuyên bố bước tiếp theo sẽ làm gì, nhưng lại chẳng hề gọi bất kỳ công cụ nào, bước tiếp theo mãi mãi chỉ dừng lại ở lời nói.
Loại thứ hai, quá lịch sự.
Đang làm dở, đột nhiên dừng lại hỏi một câu "Nếu bạn không phiền, tôi sẽ tiếp tục xử lý cái này cái kia", rồi treo máy tại chỗ, đợi bạn - người vốn chẳng có mặt trước máy tính - phải trả lời nó.
Loại thứ ba, giả vờ xin chỉ thị.
Liệt kê một loạt các hạng mục quyết định cần bạn chốt, nhưng thực tế theo cách nói của nó, những quyết định này chẳng hề ảnh hưởng đến việc nó tiếp tục làm nốt phần việc còn lại.
Loại thứ tư, ám ảnh báo cáo.
Mô hình cảm thấy số chữ trong vòng hiện tại đã đủ nhiều, hoặc vừa làm xong một giai đoạn nhỏ, thế là nhất quyết phải dừng lại để làm một bản tổng kết cho bạn.
Có chút mỉa mai là, trong các quảng cáo chính thức của Opus 5.5, "giao tiếp chủ động hơn, tóm tắt rõ ràng hơn" lại chính là điểm bán hàng cốt lõi của nó.
Ai mà ngờ được, những thói quen tốt của "học sinh giỏi" này, khi đưa vào các chương trình không người giám sát cũ, lại trở thành nguyên nhân gây đình trệ công việc.

Ba chiêu thức chính thức: Lấy lại quyền nghiệm thu từ tay AI
Làm thế nào để nó tiếp tục làm việc mà không rơi vào vòng lặp vô tận?
Phía chính thức đã đưa ra ba chiêu thức.
Chiêu thứ nhất, danh sách nhiệm vụ.
Chia nhỏ nhiệm vụ lớn thành các mục chi tiết, giao cho công cụ việc cần làm hoặc văn bản để duy trì, để mô hình vừa làm vừa tích chọn.
Khi kết thúc vòng hội thoại, nếu trong danh sách vẫn còn nhiệm vụ chưa làm xong mà mô hình cũng không giải thích bị kẹt ở đâu, ứng dụng của bạn phải tự động gửi một tin nhắn, chỉ đích danh yêu cầu nó làm tiếp.

Ví dụ tiếp tục chạy mà phía chính thức đưa ra: "Danh sách nhiệm vụ của bạn vẫn còn các mục chưa hoàn thành: di chuyển hai endpoint còn lại và cập nhật các bài kiểm thử của chúng. Tiếp tục làm đi. Nếu mục nào bị kẹt, hãy giải thích kẹt ở đâu."
Chiêu thứ hai, người nghiệm thu sắt đá.
Thiết lập tiêu chuẩn hoàn thành từ trước. Mỗi khi kết thúc vòng hội thoại, hãy đẩy cho một mô hình nhỏ hơn để đối chiếu kiểm tra. Chưa đạt chuẩn? Hãy lấy lý do chưa đạt chuẩn làm tin nhắn tiếp theo nhét lại cho nó, bắt nó làm lại.
Bài gốc còn tiếp — xem tiếp tại bài gốc ↗
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.