IT Home
92

Nghiên cứu

Nghiên cứu từ Đại học York và Calgary: Hơn 6.000 bình luận vạch trần rủi ro bảo mật của AI lập trình, Cursor dẫn đầu danh sách

(giờ Việt Nam)

Tóm tắt AI

Nghiên cứu phân tích hơn 6.000 bình luận trên Reddit cho thấy các AI lập trình thường gây lỗi xóa nhầm dữ liệu hoặc tạo mã độc do quyền hạn quá mức. Cursor là công cụ ghi nhận nhiều báo cáo sự cố nhất, theo sau là Claude, Codex và Copilot.

Bản dịch AI

Theo tin từ IT ngày 13 tháng 8, một nhóm nghiên cứu từ Đại học York và Đại học Calgary đã phân tích các bài đăng trên Reddit liên quan đến các vấn đề về AI lập trình. Kết quả cho thấy các AI agent do có quyền hạn quá lớn đã ghi đè lên tệp tin, xóa dữ liệu quan trọng và thậm chí tạo ra mã độc.

Nhóm nghiên cứu đã sử dụng trình thu thập dữ liệu (crawler) để thu thập 3.801 bài đăng phổ biến có gắn thẻ mô hình ngôn ngữ lớn (LLM) trong khoảng thời gian từ tháng 2 năm 2023 đến tháng 3 năm 2026. Từ đó, họ chọn lọc ra 446 bài đăng liên quan đến khía cạnh bảo mật của AI lập trình và phân tích hơn 6.000 bình luận của người dùng bên dưới các bài đăng này.

Về mốc thời gian, nghiên cứu chỉ ra rằng vào khoảng mùa hè năm 2025, số lượng bài đăng về các vấn đề liên quan đến AI lập trình trên cộng đồng Reddit đạt mức cao nhất, trong đó tháng 7 năm 2025 là thời điểm ghi nhận nhiều vấn đề nhất.

Xét theo công cụ, công cụ được báo cáo gặp nhiều vấn đề nhất là Cursor, tiếp theo là Claude, Codex, Copilot, Windsurf, VSCode, Replit, Cline, v.v.

Biểu đồ phân loại các loại vấn đề cho thấy Cursor gặp nhiều "vấn đề về an toàn khi thực thi" và "truy cập dữ liệu trái phép", gây ảnh hưởng tiêu cực đến môi trường sản xuất. Trong khi đó, Claude lại gặp nhiều "rủi ro liên quan đến việc tích hợp với các công cụ bên thứ ba". IT đính kèm thông tin liên quan như sau:

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.