Viện An toàn AI Anh (AISI) áp dụng khung tiêu chuẩn Every Eval Ever và Evaluation Cards của EvalEval nhằm minh bạch hóa và đảm bảo tính tái lập cho các kết quả kiểm định mô hình AI.
SkyProduction vừa ra mắt công cụ tự động kiểm duyệt phim ngắn dựa trên phụ đề, âm thanh, hình ảnh và các tiêu chuẩn nội dung, giúp nhà sản xuất xuất báo cáo lỗi nhanh chóng trước khi phát hành.
Anthropic bắt tay với Accenture để thực hiện quy trình đánh giá độc lập, bao gồm kiểm thử bảo mật, red-teaming và căn chỉnh mô hình nhằm đảm bảo an toàn cho các hệ thống AI thế hệ mới.
Vì sao đáng đọc: Tin tức quan trọng về quản trị AI và an toàn mô hình, cho thấy xu hướng các công ty AI lớn chủ động hợp tác với bên thứ ba để tăng tính minh bạch và tin cậy.
Great initiative to eval the evals. It incentivizes the industry to build genuinely high-quality ben…
DịchEpoch AI vừa công bố sáng kiến Benchmark Reviews nhằm đánh giá độ tin cậy của các bộ tiêu chuẩn AI, với kết quả ban đầu cho thấy 4 bộ đạt chuẩn, 9 bộ bị lỗi và 2 bộ chưa đủ dữ liệu. Động thái này được kỳ vọng sẽ thúc đẩy ngành công nghiệp xây dựng các tiêu chuẩn đánh giá AI chất lượng hơn.
Epoch continues to do some of the best public benchmarking work on AI. This is helpful (and tells us…
DịchEpoch AI vừa khởi động dự án Benchmark Reviews nhằm kiểm định độ tin cậy của các bộ tiêu chuẩn AI hiện nay. Kết quả ban đầu cho thấy trong 15 bộ tiêu chuẩn được kiểm tra, chỉ có 4 bộ đạt yêu cầu, trong khi 9 bộ khác bị đánh giá là có khiếm khuyết.
Startup AIUC vừa huy động thành công 40 triệu USD để phát triển dịch vụ kiểm định an toàn độc lập cho các tác nhân AI (AI Agents), nâng tổng số vốn huy động lên 55 triệu USD.
Giao thức DCP thiết lập quy trình kiểm chứng nghiêm ngặt nhằm xác minh tính xác thực của các kết quả nghiên cứu từ AI, ngăn chặn việc gian lận dữ liệu thông qua các bài kiểm tra phục hồi và phản hồi độc lập.