Hacker News: AI bài nổi bật
85

Thủ thuật

Báo động: Hơn 72% ứng dụng trên F-Droid hiện nay được tạo ra bởi AI

(giờ Việt Nam)

Tóm tắt AI

Một nghiên cứu thủ công trên 102 ứng dụng F-Droid cho thấy 72,5% mã nguồn được viết chủ yếu bởi AI, đặt ra câu hỏi lớn về chất lượng và tính minh bạch của phần mềm nguồn mở trong kỷ nguyên AI.

Bản dịch AI

How much of F-Droid is LLM generated?

Tôi yêu F-Droid. Tôi yêu những giá trị mà F-Droid đại diện và tôi thích sự tự do mà nó mang lại cho người dùng. Là một người bảo trì ứng dụng FOSS, tôi cũng chỉ có những điều tốt đẹp để nói về những con người đứng sau dự án này. Có lẽ họ còn hơi quá tử tế nữa là đằng khác, nếu xét đến việc đã bao nhiêu lần repro thất bại chỉ vì tôi quên commit trước khi build 😅.

Nhưng lạy Chúa, thật khó để tìm thấy phần mềm do con người viết ra vào thời điểm này.

Giới thiệu

Vấn đề

Đôi khi tôi mở F-Droid chỉ để lướt xem. Bạn biết đấy, có thể tôi sẽ tìm thấy một ứng dụng giải quyết được vấn đề mà trước đó tôi không hề biết là mình mắc phải, hoặc có thể tôi sẽ tìm thấy một giải pháp thay thế tốt hơn cho thứ gì đó mà tôi đang sử dụng.

Và một ngày nọ, khi đang lướt xem, tôi nhận thấy một ứng dụng có biểu tượng được tạo bằng AI trông rất xấu và lộ liễu. Nó không nằm trong danh sách và tôi sẽ không nêu tên để làm xấu mặt nó, nhưng điều đó khiến tôi suy nghĩ. F-Droid có bao nhiêu phần trăm là AI?

Là một người lập trình vì đam mê và chỉ mới là sinh viên, chưa bị vấy bẩn bởi công việc thực tế, tôi có được kiến thức về thế giới lập trình chủ yếu từ các video câu view trên YT và các bài đăng trên Reddit của những chuyên gia CS. Họ mô tả LLM hoặc là như một vị thần tái thế, hoặc chỉ là một công cụ tự động hoàn thiện văn bản được tâng bốc quá đà.

Cả hai đều rõ ràng là sai, nhưng điều đó không thực sự giúp ích gì trong việc xác định điều tôi muốn biết. Tình trạng lập trình thực tế hiện nay là gì? Mỗi khi tôi sử dụng phần mềm FOSS, khả năng nó được "vibe-code" (lập trình theo cảm hứng bằng AI) bởi một kẻ ngẫu nhiên nào đó trong một buổi chiều là bao nhiêu?

Làm thế nào để biết một ứng dụng có phải là "vibe-code" hay không?

Đó chính là cái khó—bạn không thể biết được. Văn bản đơn thuần không mang đủ thông tin meta để bất kỳ đánh giá nào có thể đạt độ chính xác cao. Tuy nhiên, giống như dấu gạch ngang (em-dash) mà tôi đã dùng trong câu đầu tiên có lẽ đã kích hoạt một hồi chuông cảnh báo trong não bạn, vẫn luôn có những dấu hiệu.

Mặc dù điều đó làm cho nhiệm vụ hiện tại nghe có vẻ thất thường và phụ thuộc vào sự tình cờ, nhưng các dấu hiệu, đặc biệt là liên quan đến các kho lưu trữ mã nguồn (repository) sử dụng LLM, không bao giờ là quá khó để tìm ra.

Bạn thấy đấy, sức hấp dẫn chính của LLM là chúng cho phép nhà phát triển lười biếng hơn. Đó chính là mục đích của nó! Bạn chỉ cần đưa ra câu lệnh (prompt), ngồi xuống và thư giãn. Vì vậy, sẽ không ngạc nhiên khi thấy thái độ này phản ánh vào mọi thứ mà một "vibe-coder" chạm tay vào.

Tại sao phải viết README từ đầu? Ha ha, cứ để LLM làm đi.

Cần review code ư? Không cần đâu, cứ để LLM tự review các thay đổi của chính nó, rồi cấp quyền truy cập vào repo cho nó luôn để bạn thậm chí không cần phải nhấn nút commit.

Nếu một dự án thực sự quan tâm đến việc trông có vẻ hợp pháp, thì việc làm những việc đó bằng tay là điều quá đơn giản. Nhưng ở đây, mọi thứ đều là sự nỗ lực tối thiểu.

Những định kiến của tôi

Phần này có thể bỏ qua nếu bạn không quan tâm đến quan điểm của tôi về LLM, nhưng tôi cần làm rõ lập trường của mình để tránh góp phần vào việc "tự sướng" tập thể quá mức.

Trước hết, tôi muốn thừa nhận rằng LLM cực kỳ hữu ích và mạnh mẽ. Khi năm 2026 trôi qua, điều này ngày càng trở nên rõ ràng hơn, nhưng việc mọi người có thể tạo ra các trò chơi và phần mềm quy mô trung bình chỉ trong một lần thử trong vòng nửa giờ là điều ấn tượng một cách nực cười, ngay cả khi sản phẩm cuối cùng thường không tốt lắm.

Tôi cũng rất ủng hộ việc phần mềm ngày càng nhanh hơn và bảo mật hơn. Câu chuyện về quá trình phát triển nhân Linux đã cho thấy LLM có khả năng tìm ra và đôi khi thậm chí giải quyết được nhiều loại vấn đề về mã nguồn.

Tuy nhiên, gạt bỏ những lời xã giao sang một bên, tôi phải thừa nhận rằng tôi thực sự ghét LLM và những gì chúng đã gây ra cho lập trình, các lĩnh vực kỹ thuật liên quan và toàn xã hội nói chung.

Sự tồn tại của chúng khiến việc tự học và thực hiện các dự án phụ thú vị trở nên kém giá trị hơn nhiều. Kiểu như, ừ thì tôi đã làm được một cái gì đó, nhưng với LLM tôi có thể làm xong trong một phần tư thời gian. Và khi bạn chấp nhận sự thật nghiệt ngã và "vibe-code", mọi thứ còn tệ hơn. Không phải bạn đã làm gì cả. Cái máy đã làm điều đó.

Sau đó là những tác động làm thoái hóa não bộ con người, khả năng khó lường của chúng trong việc cung cấp thông tin sai lệch nghe có vẻ hợp lý và thảm họa khí hậu mà chúng ta đang lờ đi. Tất cả đều là những điều rất thú vị để suy ngẫm.

Tiêu chí / Thử nghiệm

Như đã đề cập trước đó, không có cách nào để phát hiện hiệu quả các sản phẩm rác (slop), vì vậy tôi đề xuất một hệ thống 3 cấp độ dựa trên thẩm mỹ của kho lưu trữ:

Lưu ý rằng đánh giá của tôi vẫn sẽ khá hời hợt và các cấp độ khá lỏng lẻo. Tôi không xây dựng một "công cụ phát hiện rác" hay bất cứ thứ gì tương tự, vì vậy các quyết định của tôi dựa trên việc xem xét các commit gần đây và nội dung của chúng cùng với thương hiệu của dự án.

Cũng cần lưu ý rằng vì tôi không có cách nào để biết chắc chắn, nên có thể sẽ có sai sót. Tuy nhiên, tôi vẫn tin rằng hầu hết các phát hiện của mình là chính xác.

Tôi cũng sẽ không xem xét lịch sử của ứng dụng. Nếu nó đã tồn tại từ năm 2014 nhưng các commit gần đây đều do LLM viết, nó sẽ được phân loại là "Mostly AI" (Phần lớn là AI).

Các ứng dụng được chọn là đợt cập nhật được đẩy lên F-Droid vào ngày 12 tháng 9 năm 2026. Tổng cộng có 102 ứng dụng, đây là một khối lượng công việc khá lớn để tôi kiểm tra. 😅

Nếu bạn chỉ muốn xem kết quả, hãy cứ thoải mái bỏ qua đến phần kết quả.

Ứng dụng

Amber

Mô tả: Trình ký sự kiện Nostr cho Android

Kho lưu trữ: https://github.com/greenart7c3/Amber

Đánh giá: Phần lớn là AI

Giải trình: Tất cả các commit gần đây đều được thực hiện bằng LLM, các PR được chấp nhận từ các tác nhân (agent), có sự hiện diện của cơ sở hạ tầng Claude Code và Codex.

Aria for Misskey

Mô tả: Khám phá nền tảng tiểu blog liên hành tinh 🚀

Kho lưu trữ: https://github.com/poppingmoon/aria

Đánh giá: Không có dấu hiệu của AI

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hacker News: AI bài nổi bật. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.