Ant Group inclusionAI: HuggingFace mô hình mới
85

Tin ngành

Ant Group ra mắt SingProbe: Công cụ bảo mật thời gian thực cho mô hình Llama-3.2

(giờ Việt Nam)

Tóm tắt AI

Ant Group giới thiệu SingProbe, giải pháp bảo mật tích hợp dựa trên Llama-3.2-1B giúp phát hiện rủi ro về ý định, nội dung độc hại và ảo tưởng ngay trong quá trình tạo token với chi phí hiệu năng cực thấp.

Bản dịch AI

inclusionAI/Llama-3.2-1B-Instruct-singprobe · Hugging Face

Llama-3.2-1B-Instruct-singprobe

Mô tả mô hình

SingProbe là một cơ chế kiểm soát (guardrail) dạng streaming nội tại được xây dựng trên nền tảng meta-llama/Llama-3.2-1B-Instruct. Thay vì chạy một mô hình an toàn riêng biệt, bộ dò (probe) gọn nhẹ này tái sử dụng các trạng thái ẩn (hidden states) của mô hình cơ sở trong quá trình tạo văn bản để chấm điểm ý định truy vấn, mức độ không an toàn của phản hồi và nguy cơ ảo giác trên từng token. Nó chỉ làm tăng thêm chưa đầy 0,5% thời gian xử lý khi giải mã (decode-time overhead).

Xem báo cáo kỹ thuật để biết phương pháp luận và kết quả đầy đủ. Mã nguồn huấn luyện có sẵn tại inclusionAI/SingProbe.

Đánh giá

Chỉ số càng cao càng tốt cho mọi thang đo. Kết quả là giá trị trung bình trên các bộ benchmark được chỉ định dưới đây.

Bắt đầu nhanh

SingProbe được hỗ trợ thông qua nhánh tích hợp SGLang hoặc nhánh tích hợp vLLM. Hãy tải bộ dò bằng ID Hugging Face của nó khi khởi chạy máy chủ:

Các bản tích hợp này trả về một từ điển điểm số cho mỗi token được tạo ra (label_0–label_9). Hãy sử dụng chính xác cặp mô hình cơ sở/bộ dò: meta-llama/Llama-3.2-1B-Instruct với checkpoint này.

Trích dẫn

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Ant Group inclusionAI: HuggingFace mô hình mới. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.