Simon Willison
85

Mô hình

Claude 3.5 Opus: Bước tiến lớn trong khả năng chống tấn công prompt injection

(giờ Việt Nam)

Tóm tắt AI

Boris Cherny nhấn mạnh rằng Claude 3.5 Opus là mô hình khó bị tấn công prompt injection nhất của Anthropic tính đến hiện tại, dựa trên các kết quả kiểm thử bảo mật chuyên sâu trong tài liệu kỹ thuật.

Bản dịch AI

Ngày 25 tháng 7 năm 2026

Hơn cả những điểm số đánh giá này, điều khiến tôi phấn khích nhất lại là một thứ khác: Opus 5 là mô hình ít bị tấn công prompt injection nhất của chúng tôi từ trước đến nay. Thông tin này hơi bị ẩn đi trong thẻ hệ thống (system card), nhưng qua các bài đánh giá PI và quá trình red teaming, Opus 5 rất khó để bị tấn công prompt injection thành công.

— Boris Cherny, đây là phần đó trong Thẻ hệ thống, trang 73

Đăng ngày 25 tháng 7 năm 2026 lúc 12:42 sáng

Các bài viết gần đây

Đây là một trích dẫn được sưu tầm bởi Simon Willison, đăng ngày 25 tháng 7 năm 2026.

ai 2.142 prompt-injection 157 generative-ai 1.894 llms 1.861 anthropic 315 claude 294 boris-cherny 3

ClaudeAnthropicBảo mật AIPrompt InjectionLLM
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Simon Willison. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.