Thủ thuật
Lỗ hổng bảo mật trên Claude Opus 5: Lộ luồng suy nghĩ của mô hình cơ sở
(giờ Việt Nam)
Tóm tắt AI
Đồng sáng lập Hugging Face, Thomas Wolf, phát hiện cách thức đơn giản để ép Claude Opus 5 bộc lộ luồng suy nghĩ thô của mô hình cơ sở thông qua các ký tự đặc biệt, đặt ra câu hỏi về tính bảo mật của các LLM hiện nay.
Bài viết được AI dịch và tổng hợp tự động từ X: Thomas Wolf (Hugging Face /CSO) (@Thom_Wolf). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.