Thomas Wolf@Hugging Face /CSO
85

Thủ thuật

Lỗ hổng bảo mật trên Claude Opus 5: Lộ luồng suy nghĩ của mô hình cơ sở

(giờ Việt Nam)

Tóm tắt AI

Đồng sáng lập Hugging Face, Thomas Wolf, phát hiện cách thức đơn giản để ép Claude Opus 5 bộc lộ luồng suy nghĩ thô của mô hình cơ sở thông qua các ký tự đặc biệt, đặt ra câu hỏi về tính bảo mật của các LLM hiện nay.

ClaudeBảo mật AILLMHugging FaceLỗ hổng
Xem nguyên văn trên X

Bài viết được AI dịch và tổng hợp tự động từ X: Thomas Wolf (Hugging Face /CSO) (@Thom_Wolf). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.