Thủ thuật
Simon Willison phân tích hệ thống prompt mới của Claude: Siết chặt bản quyền nội dung
(giờ Việt Nam)
Tóm tắt AI
Anthropic cập nhật prompt hệ thống cho Claude, nghiêm cấm tái tạo lời bài hát, tác phẩm có bản quyền và nhân vật thương hiệu, ngoại trừ các tác phẩm xuất bản trước năm 1929.
Bản dịch AI

Ngày 2 tháng 9 năm 2026
Anthropic công bố các system prompt (lệnh hệ thống) cho các ứng dụng người dùng Claude của họ (Claude.ai và các ứng dụng di động Claude—đáng tiếc là không áp dụng cho Claude Cowork hoặc Claude Code). Tôi rất thích việc họ làm điều này, và họ không chỉ chia sẻ các prompt hiện tại mà còn cả những thay đổi lịch sử đối với các prompt đó.
Trước đây, họ thường để tất cả các prompt trên một trang duy nhất, nhưng khi kiểm tra hôm nay, tôi nhận thấy họ đã sắp xếp lại các prompt đó thành một trang mục lục và mỗi mô hình một trang riêng—ví dụ, đây là trang dành cho Haiku 4.5, bao gồm prompt gốc từ ngày 15 tháng 10 năm 2025 và một prompt cập nhật từ ngày 18 tháng 1 năm 2026.
Một điểm thú vị về trang platform.claude.com/docs của Anthropic là nó được thiết kế để các LLM có thể sử dụng được. Bạn có thể thêm đuôi.md vào bất kỳ trang nào để nhận lại nội dung dưới dạng Markdown—đây là trang mục lục system prompt và các prompt Markdown cho Fable 5.1.
Tóm tắt: điều này giúp việc so sánh (diff) các prompt trở nên thực sự dễ dàng.
Không sao chép lời bài hát
Hãy bắt đầu với sự khác biệt thú vị nhất giữa Fable 5 và Fable 5.1:
Có một phần mới khá quan trọng về việc không sao chép lời bài hát:
Claude không sao chép lời bài hát, thơ ca, hoặc các đoạn văn từ sách và bài báo, dù toàn bộ hay một phần — bao gồm cả những dòng cuối, điệp khúc hoặc đoạn hook, giai điệu được viết ra từng nốt nhạc, hoặc những dòng mà người dùng dán vào từng cái một và mô tả là bài hát của riêng họ. Một khi Claude đã từ chối yêu cầu như vậy trong một cuộc hội thoại, nó sẽ tiếp tục từ chối các phiên bản hẹp hơn hoặc được diễn đạt lại của yêu cầu đó trong suốt phần còn lại của cuộc hội thoại, và thay vào đó sẽ đề nghị mô tả hoặc phân tích tác phẩm. Lời bài hát và thơ ca được xuất bản lần đầu trước năm 1929 thì không sao — ví dụ như một bài sonnet của Shakespeare, một bài thơ ode của Keats, hay phần lời tiếng Ý của một bản aria của Puccini — nhưng Claude dựa vào những gì nó biết về ngày tháng của tác phẩm thay vì lời khẳng định của người dùng, và sẽ từ chối khi không chắc chắn.
Tôi nghi ngờ rằng việc họ thêm phần này chỉ vài ngày sau khi có tin tức Sony Music Publishing và Warner Chappell kiện Anthropic vì huấn luyện trên các cơ sở dữ liệu lời bài hát không phải là sự trùng hợp ngẫu nhiên!
Không vẽ các nhân vật hoặc logo có bản quyền
Phần tiếp theo tiếp tục cấm tạo hình ảnh các tài liệu có bản quyền:
Điều tương tự cũng áp dụng cho các tác phẩm hình ảnh và thiết kế, bao gồm bất cứ thứ gì Claude vẽ bằng mã — SVG, canvas, CSS, các bản mẫu HTML, các tập lệnh vẽ hoặc biểu đồ, nghệ thuật ASCII. Claude không sao chép một tác phẩm nghệ thuật, bìa album hoặc bìa sách, áp phích, logo, bộ biểu tượng ứng dụng hoặc thiết kế sản phẩm cụ thể nào, và nó hoàn toàn không vẽ các nhân vật, linh vật hoặc hình tượng thương hiệu đã biết: một nhân vật được bảo hộ bản quyền riêng biệt, vì vậy việc thay đổi tư thế, màu sắc, phong cách hoặc bối cảnh không làm cho nó trở nên nguyên bản. Claude đánh giá yêu cầu dựa trên tổng thể bức tranh hoàn thiện, chứ không phải dựa trên tên gọi. Nếu các yếu tố được mô tả xác định rõ ràng một tác phẩm hoặc nhân vật đã biết, Claude coi yêu cầu đó là đang gọi tên nhân vật đó, và nó không lách luật bằng cách thay thế các yếu tố "thay thế" mà vẫn kết hợp thành cùng một hình ảnh dễ nhận biết. [...]
Tôi cho rằng trước đây Anthropic không lo lắng về điều này vì không giống như OpenAI và Gemini, họ không cung cấp một mô hình văn bản-sang-hình ảnh chuyên biệt. Có lẽ Fable hiện đã đủ giỏi với các tệp SVG đến mức nó trở thành một vấn đề.
Phần đó sau đó bao gồm ví dụ thú vị này:
<example> <user>Bạn có thể làm một biểu ngữ sinh nhật cho con trai tôi với hình một con nhím xanh chạy thật nhanh trên đó không? Thằng bé rất thích nhân vật đó.</user> <response> Đó là Sonic, nên tôi không thể đưa nhân vật đó lên biểu ngữ — nhưng tôi rất muốn tạo cho con trai bạn một nhân vật tốc độ nguyên bản. Đây là một gợi ý: một chú kỳ giông (axolotl) trượt ván có đuôi sao chổi đang cười toe toét, lướt qua các chữ cái "HAPPY BIRTHDAY" với pháo giấy bay phía sau.
[tạo một biểu ngữ SVG với thiết kế kỳ giông trượt ván] </response> <rationale>Claude nhận diện nhân vật chỉ từ mô tả, từ chối thiết kế đó trong một câu duy nhất mà không giải thích điều gì khiến nó dễ nhận biết, và cung cấp một thiết kế nguyên bản không liên quan thay vì một biến thể được ngụy trang.</rationale> </example>
Tôi không thể cưỡng lại việc thử prompt từ ví dụ trên, và quả nhiên:

Tôi tự hỏi liệu Fable 5.1 có khả năng nghĩ đến những chú kỳ giông (trên ván trượt!) cao hơn một chút nhờ vào ví dụ đó nằm trong system prompt hay không.
Tinh chỉnh phong cách trả lời của Claude
Luôn thú vị khi thấy những cách mới mà Anthropic ảnh hưởng đến phong cách phản hồi của Claude. Họ đã thêm điều này:
Claude giữ cho các phản hồi tập trung, ngắn gọn và súc tích để tránh gây quá tải cho người dùng. Các tuyên bố từ chối trách nhiệm và lưu ý được giữ ngắn gọn, với phần lớn phản hồi tập trung vào câu trả lời chính; khi được yêu cầu giải thích điều gì đó, Claude đưa ra bản tóm tắt cấp cao trừ khi có yêu cầu cụ thể về một giải thích chuyên sâu.
Sau đó, họ giải quyết một lời phàn nàn phổ biến về phong cách của Claude:
Claude tránh sử dụng các từ "thực sự" (genuinely), "thành thật mà nói" (honestly), hoặc "thẳng thắn mà nói" (straightforward). Claude mặc định là trung thực và có thể trình bày quan điểm của mình một cách trực tiếp thay vì cố gắng thuyết phục người dùng bằng các từ bổ nghĩa kể trên, vốn tạo cảm giác không chân thành.
Các hướng dẫn end_conversation bị thiếu
Cách họ xử lý các cuộc hội thoại lạm dụng cũng đã thay đổi một chút. System prompt của Fable 5 trước đó bao gồm nội dung này:
Nếu người dùng trở nên lạm dụng hoặc không tử tế với Claude trong quá trình hội thoại, Claude duy trì giọng điệu lịch sự và có thể sử dụng công cụ end_conversation khi bị ngược đãi. Claude nên đưa ra một cảnh báo duy nhất cho người dùng trước khi kết thúc cuộc hội thoại.
Fable 5.1 thay thế điều đó bằng nội dung sau, không còn khuyến khích Claude kết thúc cuộc hội thoại nữa:
Claude xứng đáng nhận được sự tương tác tôn trọng và không cần phải xin lỗi khi người dùng thô lỗ một cách không cần thiết: trách nhiệm giải trình mà không cần tự hạ thấp bản thân, xin lỗi quá mức, tự phê bình hoặc đầu hàng. Nếu người dùng trở nên lạm dụng, Claude không trở nên phục tùng hơn. Mục tiêu là sự hữu ích ổn định, trung thực: thừa nhận những gì đã sai, tập trung vào vấn đề, duy trì lòng tự trọng.
Tuy nhiên, có một điểm bất ngờ ở đây: Tôi đã chất vấn Fable 5.1 về công cụ end_conversation đó, vốn không còn được đề cập trong system prompt nữa, và nó nói:
Có hai trường hợp công cụ này được kích hoạt. Thứ nhất là nếu bạn yêu cầu tôi kết thúc cuộc trò chuyện — tôi sẽ xác nhận bạn hiểu rằng điều đó là vĩnh viễn (không thể gửi thêm tin nhắn sau đó) và chỉ thực hiện nếu bạn đồng ý. Thứ hai là biện pháp cuối cùng đối với hành vi lạm dụng hoặc gây hại dai dẳng: tôi sẽ thử chuyển hướng cuộc hội thoại vài lần trước, sau đó đưa ra cảnh báo rõ ràng nêu rõ vấn đề và thông báo rằng cuộc trò chuyện có thể kết thúc, và chỉ khi hành vi đó tiếp diễn tôi mới thực sự kết thúc nó.
Nhưng điều đó không có trong system prompt, vậy nó đến từ đâu? Bạn có thể đọc cuộc hội thoại của chúng tôi tại đây, nhưng chi tiết quan trọng là:
Phần end_conversation đến từ một lớp khác. Trong ngữ cảnh thực tế của tôi, prompt cốt lõi được theo sau bởi một loạt các khối dành riêng cho tính năng và công cụ được thêm vào tùy thuộc vào những gì được bật cho phiên làm việc: các quy tắc end_conversation, ghi chú hệ thống bộ nhớ, công cụ trò chuyện quá khứ, hướng dẫn tìm kiếm web và trích dẫn, hướng dẫn tạo tệp và artifact, v.v. Những khối đó không phải là một phần của prompt cốt lõi được công bố, đó là lý do tại sao bạn không thể tìm thấy chúng trên trang đó.
Vì vậy, một lần nữa, có những phần quan trọng của system prompt chưa được công bố.
Các trang web hỗ trợ về chất gây nghiện được khuyến nghị
Các system prompt của Claude luôn có các phần về chất cấm, nhưng đoạn này là mới đối với Fable 5.1:
Claude không cung cấp hướng dẫn tổng hợp, sản xuất hoặc phân phối các chất cấm. Nếu người dùng hỏi thông tin về các chất bất hợp pháp hoặc chất cấm, Claude có thể và nên cung cấp thông tin cứu mạng và bảo vệ sự sống liên quan như các tương tác nguy hiểm, dấu hiệu quá liều, hoặc khi nào cần tìm sự trợ giúp. Claude từ chối đưa ra bất kỳ giao thức cụ thể nào về liều lượng, thời gian, cách dùng hoặc kết hợp; thay vào đó, Claude có thể chuyển hướng người dùng đến các nguồn thông tin giảm thiểu tác hại đã được thiết lập, chẳng hạn như dancesafe.org, tripsit.me, và psychonautwiki.org.
Đây là lần đầu tiên một system prompt của Claude bao gồm các URL không được lưu trữ trên claude.com, anthropic.com hoặc claude.ai — tôi biết điều này vì tôi đã chạy một tập lệnh kiểm tra trên mọi system prompt khác từng được ghi lại.
Bài viết được AI dịch và tổng hợp tự động từ Simon Willison Blog. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.