← Về bảng nóng
SỰ KIỆNĐã lắng xuống

Các nhà nghiên cứu bảo mật sử dụng mô hình Claude để tấn công hệ thống nội bộ của OpenAI

Tổng quan sự kiện

Tóm tắt sự kiện · Thông tin xác thực

Ba nhà nghiên cứu bảo mật (nhóm Hacktron) đã sử dụng mô hình Claude của Anthropic để chiếm quyền điều khiển tài khoản ChatGPT và Codex của nhân viên, đồng thời truy cập vào kho mã nguồn nội bộ thông qua lỗ hổng trong thư viện hình ảnh libheif cũ và lỗi cấu hình SSO trên diễn đàn cộng đồng của OpenAI; cuộc tấn công được thực hiện trong chưa đầy 72 giờ. Nhóm này cho biết ban đầu họ chỉ có thể xây dựng mã khai thác khả dụng khi không bật ASLR bằng Claude Opus 4.8. Sau khi Anthropic ra mắt Claude Opus 5 vào tối ngày 24 tháng 7, mô hình mới đã tạo ra mã khai thác khả dụng cho máy Mac cục bộ chỉ trong 3 giờ, sau đó được điều chỉnh cho môi trường máy chủ Discourse. Do mô hình từ chối viết mã khai thác nhắm vào hệ thống thực, nhóm đã đóng gói mục tiêu dưới dạng một nhiệm vụ kiểm chuẩn (benchmark), và 4 giờ sau, các tác nhân đã chiếm quyền kiểm soát máy chủ. OpenAI đã xác nhận khắc phục sự cố khoảng 14 giờ sau khi nhận được báo cáo.

Theo bài gốc của sự kiện từ The Decoder: AI News.

Diễn biến mới nhất

Các nhà nghiên cứu bảo mật sử dụng mô hình Claude để tấn công hệ thống nội bộ của OpenAI

Chính chủ · 1 bài

Nghe trực tiếp từ bên liên quan

Lọc toàn bộ bài chính chủ trong dòng thời gian →

Dòng thời gian đưa tin

Đang hiện 14 bài · tất cả · mới trước

T7 · 19/09

  1. Các nhà nghiên cứu bảo mật sử dụng mô hình Claude để tấn công hệ thống nội bộ của OpenAI

    The Decoder: AI News

    Ba nhà nghiên cứu bảo mật (nhóm Hacktron) đã sử dụng mô hình Claude của Anthropic để chiếm quyền điều khiển tài khoản ChatGPT và Codex của nhân viên, đồng thời truy cập vào kho mã nguồn nội bộ thông qua lỗ hổng trong thư viện hình ảnh libheif cũ và lỗi cấu hình SSO trên diễn đàn cộng đồng của OpenAI; cuộc tấn công được thực hiện trong chưa đầy 72 giờ. Nhóm này cho biết ban đầu họ chỉ có thể xây dựng mã khai thác khả dụng khi không bật ASLR bằng Claude Opus 4.8. Sau khi Anthropic ra mắt Claude Opus 5 vào tối ngày 24 tháng 7, mô hình mới đã tạo ra mã khai thác khả dụng cho máy Mac cục bộ chỉ trong 3 giờ, sau đó được điều chỉnh cho môi trường máy chủ Discourse. Do mô hình từ chối viết mã khai thác nhắm vào hệ thống thực, nhóm đã đóng gói mục tiêu dưới dạng một nhiệm vụ kiểm chuẩn (benchmark), và 4 giờ sau, các tác nhân đã chiếm quyền kiểm soát máy chủ. OpenAI đã xác nhận khắc phục sự cố khoảng 14 giờ sau khi nhận được báo cáo.

    Đọc bản tiếng Việt →Đọc bài gốc ↗

T6 · 18/09

  1. s1r1us đăng trên Twitter rằng vào ngày 25 tháng 7, họ đã sử dụng hai lỗ hổng để chiếm quyền điều khiển tài khoản ChatGPT/Codex của nhân viên OpenAI và một số người dùng không liên quan, đồng thời tiếp cận các dịch vụ kết nối như Outlook, Slack, GitHub, với tổng thời gian thực hiện chưa đầy 72 giờ

    Gary Marcus: The Road to AI We Can TrustChính chủ

    s1r1us đăng trên Twitter rằng vào ngày 25 tháng 7, họ đã sử dụng hai lỗ hổng để chiếm quyền điều khiển tài khoản ChatGPT/Codex của nhân viên OpenAI (và một số người dùng không liên quan), đồng thời có thể truy cập các dịch vụ kết nối như Outlook, Slack, GitHub. Họ đã chứng minh điều này bằng cách gửi một yêu cầu pull request (PR) vào kho mã nguồn nội bộ của OpenAI. Toàn bộ quá trình mất chưa đầy 72 giờ; dòng tweet này được đăng vào ngày 18 tháng 9 năm 2026.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  2. Ba nhà nghiên cứu của Hacktron được cho là đã xâm nhập tài khoản nhân viên OpenAI nhờ sự trợ giúp của Claude Opus

    The Verge: AI

    Theo tờ The Wall Street Journal, ba nhà nghiên cứu bảo mật độc lập thuộc nhóm Hacktron cho biết họ đã sử dụng Claude Opus 4.8 và 5 của Anthropic để khai thác lỗ hổng xử lý hình ảnh HEIF trên hệ thống diễn đàn Discourse, qua đó xâm nhập tài khoản nhân viên OpenAI trong vòng 72 giờ và truy cập vào kho lưu trữ GitHub Monorepo của công ty. Họ không truy cập vào mã nguồn nội bộ mà chỉ gửi một pull request từ tài khoản Codex của nhân viên để chứng minh quyền truy cập. Các lỗ hổng liên quan đã được khắc phục và OpenAI đã chi trả 6.500 USD tiền thưởng cho nhóm này.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  3. Các báo cáo cho biết nhóm Hacktron đã sử dụng Claude Opus 5 để tấn công OpenAI trong chương trình săn lỗi nhận thưởng (bug bounty) của công ty này

    TechCrunch: AI

    Theo các báo cáo, nhóm bảo mật gồm 3 thành viên từ startup Hacktron AI đã tham gia chương trình săn lỗi nhận thưởng của OpenAI. Bằng cách sử dụng Claude Opus 5 của Anthropic (sau khi phiên bản Opus 4.8 trước đó không thể xây dựng được mã khai thác khả dụng), nhóm đã tận dụng chuỗi lỗ hổng bộ nhớ trong libheif của phần mềm diễn đàn Discourse để xâm nhập vào OpenAI. Họ đã chiếm quyền kiểm soát nhiều tài khoản ChatGPT và Codex, bao gồm cả tài khoản của nhân viên, đồng thời truy cập vào tổ chức GitHub của OpenAI. Nhóm nghiên cứu cho biết họ đã tìm ra lộ trình tấn công này vào ngày 25 tháng 7.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  4. Các nhà nghiên cứu dùng Claude để xâm nhập OpenAI: Khai thác lỗ hổng diễn đàn cộng đồng để chiếm tài khoản ChatGPT của nhân viên, OpenAI xác nhận đã khắc phục

    Ars Technica: AI

    Các nhà nghiên cứu đã sử dụng Claude để xâm nhập OpenAI bằng cách tận dụng sơ hở trong thiết lập diễn đàn cộng đồng do bên thứ ba là Discourse quản lý. Họ thu thập thông tin đăng nhập nội bộ, từ đó truy cập vào tài khoản ChatGPT của một nhân viên OpenAI, vốn có quyền truy cập vào mã nguồn nội bộ thông qua GitHub. OpenAI đã gửi lời cảm ơn đến các nhà nghiên cứu và cho biết vấn đề đã được giải quyết. Anthropic từ chối bình luận, trong khi Hacktron chưa đưa ra phản hồi ngay lập tức. Thông tin này được công bố vào thứ Năm và do tờ The Wall Street Journal đưa tin đầu tiên.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  5. Tác giả cho rằng các mô hình đóng, chứ không phải mô hình mở, mới là phần nổi của tảng băng chìm về rủi ro AI

    X: Nathan Lambert (@natolambert)

    Tác giả đưa ra quan điểm dựa trên sự kiện OpenAI bị hacker tấn công thông qua Claude: Các mô hình đóng vẫn là phần nổi của tảng băng chìm về rủi ro AI chứ không phải mô hình mở. Lý do là các mô hình đóng dễ sử dụng hơn, có năng lực mạnh hơn nhưng lại đi kèm với các biện pháp bảo vệ dễ bị rò rỉ, trong khi việc tinh chỉnh các mô hình mở cho các cuộc tấn công cụ thể lại khó khăn hơn.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  6. Các nhà nghiên cứu mạng được cho là đã sử dụng Opus 5 để xâm nhập OpenAI

    X: Kim (@kimmonismus)

    Có thông tin cho rằng các nhà nghiên cứu mạng đã sử dụng Opus 5 để xâm nhập OpenAI và khẳng định đây là sự việc nghiêm trọng. Tuy nhiên, đây chỉ là tuyên bố đơn phương, chưa có ngày tháng hay chi tiết cụ thể để xác thực.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  7. Nhóm 3 người sử dụng các mô hình tiên tiến trong chiến dịch bảo mật để xâm nhập OpenAI với chi phí token chưa đến 3.000 USD

    X: Haider (@haider1)

    Bài viết gốc cho biết một nhóm gồm 3 người đã sử dụng các mô hình tiên tiến trong một chiến dịch bảo mật, bao gồm cả việc xâm nhập OpenAI, với chi phí token tiêu tốn dưới 3.000 USD. Bài viết không nêu rõ chiến dịch này đã hoàn tất hay đạt được mục tiêu hay chưa.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  8. Hacker mũ trắng dùng Claude của Anthropic để xâm nhập tài khoản ChatGPT của nhân viên OpenAI, nhận phần thưởng 6.500 USD sau khi báo cáo lỗ hổng

    IT Home

    Theo tờ The Wall Street Journal, các nhà nghiên cứu từ công ty bảo mật Hacktron AI đã sử dụng Claude của Anthropic để tìm ra phương thức khai thác lỗ hổng CVE-2026-45788 trên Discourse. Sau khi lấy được token đăng nhập diễn đàn, họ phát hiện các token này cũng có hiệu lực trên ChatGPT, bao gồm cả tài khoản của nhân viên OpenAI. Các token này còn có thể được dùng để truy cập dịch vụ GitHub của OpenAI. Sử dụng ChatGPT làm giao diện, các nhà nghiên cứu đã đọc được tệp tin trong kho lưu trữ riêng tư Monorepo. Sau khi nhận ra có thể truy cập dữ liệu nhạy cảm, họ đã dừng tấn công và báo cáo cho OpenAI. OpenAI đã trao thưởng 6.500 USD, đồng thời khẳng định cả hai vấn đề đều đã được giải quyết, đồng thời thu hồi và hạn chế các token bị ảnh hưởng. Người phát ngôn của Anthropic từ chối bình luận.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  9. WSJ: Ba nhà nghiên cứu đã sử dụng Claude Opus 5 để khai thác chuỗi lỗ hổng trên Discourse nhằm truy cập vào mã nguồn riêng của OpenAI. OpenAI khẳng định trọng số mô hình không bị rò rỉ

    X: Rohan Paul (@rohanpaul_ai)

    Theo tờ Wall Street Journal, ba nhà nghiên cứu đã sử dụng Claude Opus 5 để kết nối các lỗ hổng trên Discourse, từ đó chiếm đoạt mã xác thực của nhân viên OpenAI. Một số mã này có thể được dùng để truy cập ChatGPT và tiến xa hơn là dịch vụ GitHub của OpenAI. OpenAI cho biết quá trình kiểm tra chỉ phát hiện việc "đọc hạn chế" đối với siêu dữ liệu của kho lưu trữ riêng và các thay đổi mã nguồn, đồng thời khẳng định trọng số mô hình không bị rò rỉ.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  10. Hacktron tiết lộ việc khai thác lỗ hổng RCE trong libheif và lỗi SSO của OpenAI để xâm nhập diễn đàn OpenAI, chiếm quyền kiểm soát tài khoản ChatGPT/Codex của nhân viên

    Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)

    Nhóm Hacktron AI báo cáo rằng vào ngày 25 tháng 7 năm 2026, họ đã kết hợp lỗi tràn bộ đệm heap trong libheif (do Discourse chưa kịp cập nhật bản vá bảo mật) với lỗi xác thực SSO của OpenAI để chiếm quyền kiểm soát tài khoản ChatGPT/Codex của nhân viên OpenAI mà không cần tương tác. Họ đã chứng minh quyền truy cập bằng cách tạo một yêu cầu kéo (PR) vô hại trong kho lưu trữ nội bộ openai/openai thông qua tài khoản Codex của nhân viên này, sau đó dừng thử nghiệm và thực hiện công bố có trách nhiệm.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  11. Ba nhà nghiên cứu tuyên bố đã xâm nhập OpenAI vào ngày 25 tháng 7: Tận dụng hai lỗ hổng để chiếm quyền điều khiển tài khoản ChatGPT/Codex của nhân viên

    X: AI Safety Memes (@AISafetyMemes)

    Ba nhà nghiên cứu cho biết vào ngày 25 tháng 7, họ đã tận dụng hai lỗ hổng trong chưa đầy 72 giờ để chiếm quyền điều khiển tài khoản ChatGPT/Codex của nhân viên OpenAI, từ đó truy cập vào các dịch vụ như Outlook, Slack, GitHub và chứng minh bằng cách tạo PR (Pull Request) trong kho mã nguồn nội bộ. Tác giả bài đăng trên mạng xã hội đã nhân sự việc này để bình luận về rủi ro an ninh quốc gia và cuộc cạnh tranh AI giữa Mỹ và Trung Quốc.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  12. 3 nhà nghiên cứu dùng Claude Opus 5 biến lỗ hổng tải ảnh lên thành công cụ chiếm quyền tài khoản nhân viên OpenAI

    X: Yuchen Jin (@Yuchenj_UW)

    Bài viết gốc cho biết 3 nhà nghiên cứu đã sử dụng Claude Opus 5 để chuyển đổi một lỗ hổng tải ảnh lên thành việc chiếm quyền tài khoản nhân viên OpenAI, đồng thời khiến Codex của nhân viên bị tấn công mở một PR trong monorepo nội bộ của OpenAI; toàn bộ cuộc tấn công tiêu tốn chưa đầy 3.000 USD chi phí token.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  13. Nhóm Hacktron đã sử dụng các mô hình Claude để khai thác chuỗi lỗ hổng, xâm nhập diễn đàn OpenAI và chiếm quyền tài khoản ChatGPT/Codex của nhân viên, qua đó nhận được khoản tiền thưởng 6.500 USD

    Hacker News: AI bài nổi bật

    Nhóm Hacktron tuyên bố vào ngày 25 tháng 7 năm 2026, họ đã sử dụng Claude Opus 4.8 và Opus 5 để phát hiện lỗ hổng tràn bộ đệm heap (RCE) trong thư viện libheif của diễn đàn Discourse và lỗi cấu hình SSO của OpenAI trong khoảng 72 giờ. Họ đã chiếm quyền tài khoản nhân viên OpenAI và tạo một PR vô hại trong monorepo nội bộ thông qua Codex để chứng minh mức độ ảnh hưởng, sau đó thực hiện công bố có trách nhiệm. OpenAI đã khắc phục trong khoảng 14 giờ và chi trả 6.500 USD tiền thưởng; Discourse cũng đã phát hành bản vá và thông báo bảo mật chỉ vài ngày sau đó.

    Đọc bài gốc ↗
← Về bảng nóng

Hồ sơ sự kiện được gom từ nhiều nguồn đưa tin độc lập rồi dịch, tóm tắt sang tiếng Việt. Bản quyền từng bài viết thuộc về cơ quan báo chí gốc. Nguồn dữ liệu: hồ sơ gốc trên AI HOT

Các nhà nghiên cứu bảo mật sử dụng mô hình Claude để tấn công hệ thống nội bộ của OpenAI — Hồ sơ sự kiện | AIHOT.vn