LangSmith Engine v2 ra mắt tính năng Red Teaming và kiểm thử tác nhân tự động
LangSmith Engine v2 vừa được cập nhật với khả năng Red Teaming giúp chủ động phát hiện lỗi của tác nhân AI, đồng thời hỗ trợ quy trình kiểm thử tự động toàn diện.
LangSmith Engine v2 vừa được cập nhật với khả năng Red Teaming giúp chủ động phát hiện lỗi của tác nhân AI, đồng thời hỗ trợ quy trình kiểm thử tự động toàn diện.
Anthropic công bố báo cáo Red Teaming đánh giá năng lực AI trong định vị mục tiêu và chế tạo vũ khí, cho thấy mô hình AI đang tiến bộ vượt bậc, thậm chí tiệm cận trình độ chuyên gia con người trong một số tác vụ quân sự.
Diễn biến sự kiện · 3 bài →Thêm 1 nguồn khác đưa tinX: Hongming (@hongming731)
Ethan Mollick@emollickThat didn't take long.
DịchAbliteration vừa phát hành mô hình abliterated-model-large-v2, phiên bản đã loại bỏ kiểm duyệt của GLM-5.3, tối ưu cho kiểm thử bảo mật, red teaming và các tác vụ Agent phức tạp với cửa sổ ngữ cảnh 1 triệu token.
Thêm 1 nguồn khác đưa tinX: Kim (@kimmonismus)OpenART là nền tảng kiểm thử bảo mật (red teaming) quy mô lớn, sử dụng hơn 10.000 kịch bản trạng thái phức tạp để đánh giá khả năng ứng biến của các tác nhân AI trong môi trường dài hạn, khắc phục hạn chế của các bài kiểm tra tĩnh hiện nay.