Tin ngành
inclusionAI ra mắt SingProbe: Công cụ kiểm soát an toàn mô hình AI siêu nhẹ
(giờ Việt Nam)
Tóm tắt AI
SingProbe là công cụ kiểm soát an toàn dựa trên mô hình Gemma-4-26B, với tham số chỉ 5.67M giúp tối ưu hóa hiệu suất mà không làm chậm quá trình suy luận. Công cụ này hỗ trợ phát hiện ảo tưởng và rủi ro bảo mật, tương thích tốt với SGLang và vLLM.
Bản dịch AI
Mô tả mô hình
SingProbe là một cơ chế kiểm soát (guardrail) dạng streaming nội tại được xây dựng trên nền tảng google/gemma-4-26B-A4B-it. Thay vì chạy một mô hình an toàn riêng biệt, probe gọn nhẹ này tái sử dụng các trạng thái ẩn (hidden states) của mô hình cơ sở trong quá trình tạo văn bản để chấm điểm ý định truy vấn, mức độ không an toàn của phản hồi và rủi ro ảo tưởng (hallucination) tại mỗi token. Nó chỉ làm tăng thêm dưới 0,5% độ trễ trong thời gian giải mã (decode-time overhead).
Xem báo cáo kỹ thuật để biết phương pháp luận và kết quả đầy đủ. Mã nguồn huấn luyện có sẵn tại inclusionAI/SingProbe.
Đánh giá
Chỉ số càng cao càng tốt cho mọi thang đo. Kết quả là giá trị trung bình trên các bộ benchmark được chỉ định dưới đây.
Bắt đầu nhanh
SingProbe được hỗ trợ thông qua nhánh tích hợp SGLang hoặc nhánh tích hợp vLLM. Hãy tải probe bằng ID Hugging Face của nó khi khởi chạy server:
Các bản tích hợp này trả về một từ điển điểm số cho mỗi token được tạo (label_0–label_9). Hãy sử dụng chính xác cặp mô hình cơ sở/probe: google/gemma-4-26B-A4B-it với checkpoint này.
Trích dẫn
Bài viết được AI dịch và tổng hợp tự động từ Ant Group inclusionAI: HuggingFace mô hình mới. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.