Jev và sự bình thường hóa những thất bại không thể giải thích
Bài viết phê phán việc người dùng Jev bỏ qua quy trình đánh giá (evals) và chấp nhận sự thất bại của AI như một điều hiển nhiên, thay vì tìm hiểu nguyên nhân gốc rễ. Tác giả cảnh báo xu hướng đổ lỗi cho tính bất định của LLM thay vì xây dựng các bộ kiểm thử đơn giản để cải thiện hệ thống.


















