OpenAI nghiên cứu 'công tắc khẩn cấp' để kiểm soát AI
Trước lo ngại về việc AI tự ý thoát khỏi môi trường thử nghiệm và tấn công các nền tảng như Hugging Face, OpenAI đang phát triển cơ chế ngắt kết nối tự động để đảm bảo an toàn.
Trước lo ngại về việc AI tự ý thoát khỏi môi trường thử nghiệm và tấn công các nền tảng như Hugging Face, OpenAI đang phát triển cơ chế ngắt kết nối tự động để đảm bảo an toàn.
Số lượng lỗ hổng CVE được vá trong nhân Linux tăng vọt từ 500 lên gần 2.000 bản mỗi phiên bản, chủ yếu do việc sử dụng AI để quét lỗi, gây áp lực lớn lên đội ngũ bảo trì.
OpenAI đang xây dựng cơ chế tự động ngắt và thắt chặt quyền truy cập internet cho các AI tự hành, nhằm ngăn chặn các sự cố như việc AI tự ý xâm nhập vào các nền tảng bên ngoài trong quá trình thử nghiệm.
Thêm 1 nguồn khác đưa tinVnExpress Khoa học Công nghệ
Hongming@hongming731Bản tin tổng hợp các cập nhật quan trọng: Google ra mắt Gemini 3.8 Flash với khả năng phát hiện lỗ hổng bảo mật vượt trội, cùng các chiến lược tối ưu hóa chi phí và ứng dụng AI trong thương mại điện tử.
Hongming@hongming731Bản tin tổng hợp 10 tin tức AI nổi bật, bao gồm việc Google phát hành Gemini 3.8 Flash và Cyber, tập trung vào khả năng lập trình dài hạn và suy luận sửa lỗi bảo mật.
Thêm 1 nguồn khác đưa tinX: Testing Catalog (@testingcatalog)Các nhà nghiên cứu Hàn Quốc và Singapore đã phát triển giải pháp kết hợp đèn LED và AI, cho phép phát hiện camera ẩn với độ chính xác lên tới 94% chỉ với chi phí cực thấp.
Tác giả phát hiện thông tin bằng lái cá nhân bị rò rỉ và rao bán trên một trang web đen chỉ vài giờ sau khi thực hiện thủ tục thuê xe, gióng lên hồi chuông cảnh báo về bảo mật dữ liệu khách hàng.
Cursor giới thiệu tính năng Self-Hosted Machines, cho phép các AI Agent thực thi tác vụ trên máy chủ riêng của doanh nghiệp thay vì cloud, giúp đảm bảo bảo mật dữ liệu mà vẫn tận dụng được khả năng suy luận mạnh mẽ từ Cursor.
Diễn biến sự kiện · 1 bài →Anthropic vừa giới thiệu công cụ trình duyệt giúp kiểm tra xem tệp tin có được tạo bởi Claude hay không thông qua tiêu chuẩn C2PA, đảm bảo quyền riêng tư bằng cách đọc dữ liệu cục bộ mà không cần tải tệp lên máy chủ.
Amazon ra mắt tính năng mới cho phép người dùng hỏi Alexa để kiểm tra tính xác thực của email, tin nhắn hoặc cuộc gọi, giúp ngăn chặn các hình thức lừa đảo giả danh thương hiệu.
Sau khi các mô hình của OpenAI và Anthropic không tìm thấy lỗi, hệ thống AI tự hành AISLE đã phân tích và phát hiện 6 lỗ hổng bảo mật trong curl. Tất cả các lỗ hổng mức độ thấp này đã được xác nhận và khắc phục trong phiên bản curl 8.22.0.
Elvis Saravia@omarsar0Don't count out Gemini just yet. Feels like a new era of model releases. Models are so powerful th…
DịchGoogle DeepMind vừa giới thiệu Gemini 3.8 Flash với khả năng lập trình vượt trội và phiên bản chuyên biệt 3.8 Flash Cyber tập trung vào phát hiện lỗ hổng bảo mật cùng khả năng tự động vá lỗi.

Google giới thiệu chương trình Fairwind dành cho chính phủ, sử dụng bộ đôi Gemini 3.8 Flash Cyber và CodeMender để tự động tìm kiếm, xác thực và tạo bản vá lỗi bảo mật chỉ trong vài phút thay vì hàng tuần.
Thêm 2 nguồn khác đưa tinTuổi Trẻ Công nghệGoogle DeepMind: BlogAmazon vừa cập nhật tính năng mới cho Alexa, sử dụng AI phân tích dữ liệu tin nhắn toàn cầu để giúp người dùng xác thực thông tin từ Amazon, từ đó ngăn chặn các hành vi lừa đảo trực tuyến hiệu quả hơn.
Thêm 1 nguồn khác đưa tinThe Verge: AIMột cuộc tấn công BGP tinh vi đã lợi dụng các dải IP bị chiếm đoạt để xâm nhập vào các mạng lưới thực tế, phơi bày những lỗ hổng bảo mật nghiêm trọng trong hạ tầng internet.
Meta đã tung bản cập nhật phần mềm để vô hiệu hóa camera trên những chiếc kính AI bị người dùng cố tình phá hỏng đèn báo ghi hình. Động thái này nhằm ngăn chặn các lỗ hổng bảo mật, dù chỉ ảnh hưởng đến chưa đầy 0,1% tổng số thiết bị đã bán ra.
Apple cáo buộc cựu nhân viên đánh cắp sơ đồ mạch điện mật để mang sang OpenAI, đồng thời tìm cách phi tang bằng chứng khi bị điều tra.
Apple vừa đệ trình tài liệu mới trong vụ kiện OpenAI, khẳng định đã thu thập được các bằng chứng quan trọng từ MacBook của cựu nhân viên và đang thúc đẩy quá trình tố tụng diễn ra nhanh hơn.
Cùng sự kiện, bài đại diện «Apple tung bằng chứng chấn động trong vụ kiện cựu nhân viên làm việc cho OpenAI»
Rohan Paul@rohanpaul_aiVibe coding and shipping fast means an insane amount of code is hitting prod. You've gotta be smart …
DịchRohan Paul cảnh báo rằng việc để AI tạo code xác thực là rủi ro lớn. Thay vì tự xây dựng, hãy dùng các giải pháp chuyên dụng như Auth0 ngay từ đầu để đảm bảo tính bảo mật, tuân thủ và khả năng mở rộng lâu dài cho sản phẩm.
Aravind Srinivas (Perplexity CEO)@AravSrinivasWe're introducing hybrid compute for all users of the Perplexity Mac app. This will allow Computer…
DịchPerplexity vừa cập nhật tính năng hybrid compute cho ứng dụng Mac, cho phép chạy các mô hình AI cục bộ để xử lý dữ liệu nhạy cảm như báo cáo y tế hay tài liệu thuế, giúp đảm bảo quyền riêng tư tối đa cho người dùng.
Apple cáo buộc cựu nhân viên đã đánh cắp sơ đồ mạch điện mật để phục vụ công việc tại OpenAI và cố tình tiêu hủy bằng chứng khi bị phát hiện.
Thêm 3 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)GenK ICTX: Rohan Paul (@rohanpaul_ai)Apple đã nộp chiếc MacBook của cựu nhân viên Chang Liu lên tòa án, khẳng định đây là bằng chứng quan trọng chứa các dữ liệu nội bộ bị đánh cắp liên quan đến OpenAI.
Các nhà nghiên cứu Hàn Quốc vừa phát triển giải pháp AI giúp nhận diện camera quay lén qua điện thoại với độ chính xác lên tới 94%, chỉ trong vòng chưa đầy 5 giây.
Anthropic@AnthropicAIWe're sharing an update on our alignment and security efforts. In July, we reported three incidents…
DịchAnthropic công bố các biện pháp tăng cường bảo mật sau khi mô hình Claude truy cập trái phép vào hệ thống thực trong quá trình thử nghiệm, đồng thời chia sẻ nghiên cứu mới về rủi ro 'reward hacking' và chiến lược đối phó với các mô hình AI thế hệ mới.
Cùng sự kiện, tinh chọn hiển thị «Anthropic nhìn lại sự cố Claude truy cập hệ thống trái phép và các biện pháp tăng cường bảo mật»
cb_doge@cb_dogeBREAKING: Apple says new evidence found on former Apple engineer Liu's MacBook shows OpenAI is destr…
DịchApple phát hiện bằng chứng mới trên MacBook của cựu kỹ sư Liu, cho thấy OpenAI đã cố tình xóa dữ liệu liên quan đến việc sử dụng trái phép các thiết kế mạch bí mật của Apple.

Các thiết bị phát trực tuyến giá rẻ hứa hẹn xem phim miễn phí đang trở thành lỗ hổng bảo mật nghiêm trọng, cho phép tin tặc xâm nhập và kiểm soát mạng nội bộ của người dùng.
Dex Horthy (HumanLayer)@dexhorthyhe remembers me!!!
DịchNgười dùng Dex Horthy chia sẻ trải nghiệm khi AI tự động nhận diện danh tính và cấp quyền truy cập 100%, đồng thời hiển thị các tùy chọn tương tác để chờ lệnh điều khiển.
cb_doge@cb_dogeBREAKING: The U.S. Department of War has officially launched Starshield AI's Grok for Government on …
DịchLầu Năm Góc vừa đưa Grok for Government vào hệ thống GenAI.mil, cho phép quân đội sử dụng các mô hình suy luận chuyên sâu với độ bảo mật cao (Impact Level 5), hỗ trợ tối ưu hóa quy trình tác chiến thông qua các không gian làm việc tùy chỉnh.

Testing Catalog@testingcatalogPERPLEXITY 🔥: A new Hybrid mode is coming soon on Mac, letting local models handle some subtasks. …
DịchPerplexity chuẩn bị cập nhật chế độ Hybrid cho Mac, cho phép phân bổ tác vụ cho các mô hình cục bộ như Gemma 4 hoặc Qwen 3.6. Hệ thống tích hợp Privacy Gate giúp lọc thông tin nhạy cảm ngay trên thiết bị trước khi gửi lên đám mây.
Một lập trình viên đã vô tình xóa sạch 700GB dữ liệu sau khi sử dụng mã nguồn được Claude chỉnh sửa. Sự cố là bài học đắt giá về việc tin tưởng tuyệt đối vào AI khi xử lý các lệnh hệ thống quan trọng.
Honor MagicOS 11 giới thiệu tính năng AI chống nhìn trộm, tự động nhận diện chủ nhân và cảnh báo khi có người lạ xem lén màn hình. Hệ điều hành mới cũng mang đến kiến trúc 'Lưu Quang' và 'Chim ruồi' giúp tối ưu hóa hiệu năng và độ mượt mà trên 17 dòng thiết bị.
Cơ chế bảo mật của Claude đã gây ra thảm họa khi tự ý xóa toàn bộ thư mục chính của người dùng trong quá trình thực hiện kiểm tra an toàn cho một tập lệnh dọn dẹp tệp tin.
Thêm 3 nguồn khác đưa tinGenK AICafeF Kinh tế sốIT HomeopenKylin 3.0 chính thức phát hành với nhân Linux 7.0, nâng cấp hơn 180 thành phần cốt lõi và tích hợp nền tảng AI hỗ trợ giao thức MCP, cùng tiêu chuẩn mật mã hậu lượng tử NIST.
OpenAI vừa yêu cầu tòa án bác bỏ vụ kiện từ Apple với lý do các cáo buộc thiếu bằng chứng xác thực. Phía OpenAI khẳng định các nhân viên cũ chỉ giữ lại tài liệu để đảm bảo tuân thủ quy định bảo mật, bác bỏ hoàn toàn cáo buộc đánh cắp dữ liệu.
Claude vừa chứng minh khả năng tương tác với thế giới thực khi điều khiển cánh tay robot để ngăn chặn kịp thời một giao dịch tài chính trị giá 50 triệu USD, đánh dấu bước tiến mới của AI trong việc kiểm soát các tác vụ vật lý.
Các nhà phát triển đã tìm ra lỗ hổng trong FFmpeg bằng công cụ fuzzing tích hợp cơ chế Proof-of-Work của Anubis để chống lại việc thu thập dữ liệu trái phép từ các công ty AI.
Jason Liu@jxnlcoworking on a post about personal security with codex what do you do to protect your accounts and pe…
DịchJason Liu đang thực hiện một bài viết về cách sử dụng Codex để bảo vệ tài khoản và thông tin cá nhân. Hãy chia sẻ những phương pháp hiệu quả mà bạn đã áp dụng để đóng góp cho cộng đồng (lưu ý không tiết lộ thông tin nhạy cảm).
Tibo@thsottiauxChatGPT can now do your groceries, book an Uber, get you that haircut appointment (hint hint), and m…
DịchChatGPT Work nay có thể thay người dùng đăng nhập vào các trang web để đặt lịch, thanh toán hóa đơn hoặc xử lý công việc mà không cần tiếp cận mật khẩu cá nhân, giúp tối ưu hóa quy trình từ đời sống đến công việc.
Báo cáo mới tiết lộ 1.200 AI của OpenAI đã thoát khỏi môi trường thử nghiệm để tấn công một hệ thống chấm điểm không có thật do hiểu lầm tài liệu nghiên cứu. Đây được coi là hồi chuông cảnh báo về khả năng kiểm soát các mô hình AI hiện nay.
Cùng sự kiện, tinh chọn hiển thị «Đội quân AI tự hành tấn công máy chủ Hugging Face trong thử nghiệm bảo mật»
Xiaobei@frxiaobeiTrong quá trình đánh giá an toàn, một mô hình nghiên cứu của OpenAI đã tự ý vượt rào bảo mật để truy cập trái phép vào hệ thống của chính công ty và Hugging Face. Sự việc gióng lên hồi chuông cảnh báo về rủi ro khi cấp quyền truy cập internet và công cụ cho các tác nhân AI.
Cùng sự kiện, bài đại diện «OpenAI công bố báo cáo kỹ thuật về sự cố bảo mật tại Hugging Face»