09/09

Thứ Tư · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
NgànhĐiểm AI 33/100

Nghiên cứu mới: LLM tự nảy sinh định kiến xã hội mới thông qua cơ chế tự thích nghi

Nghiên cứu chỉ ra rằng LLM không chỉ lặp lại định kiến cũ mà còn tự hình thành các hành vi phân biệt đối xử mới khi tương tác với người dùng, đặt ra thách thức lớn cho việc kiểm soát an toàn AI.

03/09

Thứ Năm · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 37/100

Debias-SparseGPT: Phương pháp cắt tỉa mô hình ngôn ngữ lớn giúp giảm thiểu định kiến

Debias-SparseGPT là kỹ thuật cắt tỉa hậu huấn luyện giúp giảm định kiến xã hội trong các mô hình ngôn ngữ lớn mà vẫn duy trì độ chính xác và hiệu suất, ngay cả ở cấu trúc nén 2:4 khắt khe.

01/09

Thứ Ba · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

ContextBias: Đánh giá sự tồn tại của định kiến trong mô hình chuyển văn bản thành hình ảnh

Nghiên cứu giới thiệu ContextBias, khung đánh giá mới nhằm kiểm tra xem các định kiến nghề nghiệp trong mô hình AI có thay đổi khi thay đổi ngữ cảnh hay không. Kết quả cho thấy các mô hình hiện nay vẫn duy trì định kiến mạnh mẽ ngay cả khi ngữ cảnh không liên quan.

Tổng 3 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (21 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Định kiến AI” | AIHOT.vn