MarkTechPost
85

Mô hình

Sakana AI ra mắt Fugu-Cyber: Mô hình chuyên biệt cho an ninh mạng với hiệu suất ấn tượng

(giờ Việt Nam)

Tóm tắt AI

Sakana AI giới thiệu Fugu-Cyber, mô hình tối ưu hóa cho suy luận bảo mật, đạt tỷ lệ thành công 86,9% trên CyberGym. Dịch vụ hiện yêu cầu đăng ký phê duyệt và chưa khả dụng tại khu vực EU/EEA.

Bản dịch AI

Sakana AI Releases Fugu-Cyber: An Orchestration Model Reporting 86.9% on CyberGym and 72.1% on CTI-REALM

Sakana AI vừa ra mắt Fugu-Cyber (ID mô hình là fugu-cyber-v1.0), một sự bổ sung chuyên biệt về an ninh mạng cho dòng sản phẩm điều phối Fugu của hãng. Đây không chỉ là một mô hình tiên phong (frontier model) mới, mà là điểm cuối (endpoint) thứ ba trên bộ điều phối Fugu, được tinh chỉnh để suy luận về bảo mật. Sakana đã ra mắt bộ điều phối đó một tháng trước.

Sakana báo cáo tỷ lệ thành công đạt 86,9% trên CyberGym và 72,1% trên CTI-REALM. Họ mô tả những kết quả này tương đương với các mô hình tiên phong tập trung vào an ninh mạng như GPT-5.5-Cyber và Claude Mythos Preview.

Các bài kiểm tra này thực sự đo lường điều gì

Hai đánh giá này nằm ở hai đầu đối lập của một quy trình làm việc bảo mật:

Kết hợp lại, bộ đôi này bao quát từ việc "tìm và chứng minh lỗi" đến "chuyển đổi thông tin tình báo thành khả năng phát hiện". Cách đặt vấn đề đó là phần hợp lý nhất trong thông báo của Sakana.

Vị thế của con số 86,9% so với thị trường

Bối cảnh quan trọng hơn con số.

Khi các nhà nghiên cứu CyberGym công bố kết quả đầu tiên, sự kết hợp tốt nhất giữa tác nhân (agent) và mô hình chỉ đạt khoảng 20%. Anthropic đã báo cáo tỷ lệ 83,1% cho Claude Mythos Preview trong khuôn khổ Project Glasswing vào tháng 4 năm 2026. OpenAI báo cáo 85,6% cho phiên bản GPT-5.5-Cyber cập nhật, so với 81,8% của GPT-5.5. Do đó, con số 86,9% của Sakana chỉ là một bước tiến nhỏ vượt qua ngưỡng tiên phong hiện tại, chứ không phải là một cú nhảy vọt.

CTI-REALM lại là một câu chuyện khác. Đánh giá của chính Microsoft cho thấy ba cấu hình hàng đầu, đều là Claude, nằm trong khoảng từ 0,624 đến 0,685. Con số 72,1% của Fugu-Cyber sẽ nằm trên ngưỡng đó. Tuy nhiên, có một lưu ý quan trọng: CTI-REALM được chấm điểm dưới dạng phần thưởng quỹ đạo (trajectory reward) từ 0 đến 1, chứ không phải tỷ lệ đạt/không đạt. Dù vậy, Sakana vẫn gọi đó là tỷ lệ thành công.

Cách thức hoạt động của quá trình điều phối

Bản thân Fugu là một mô hình ngôn ngữ. Nó được huấn luyện để đọc truy vấn và xây dựng một khung tác nhân (agentic scaffold) ngay lập tức. Sau đó, nó ủy quyền các tác vụ phụ cho các mô hình chuyên biệt trong một nhóm.

Phương pháp này được ghi lại trong báo cáo kỹ thuật của Fugu và hai bài báo tại ICLR 2026 là TRINITY và Conductor. TRINITY phân bổ các vai trò Thinker (Người suy nghĩ), Worker (Người thực thi) và Verifier (Người kiểm chứng) cho nhiều LLM khác nhau. Conductor học các chiến lược phối hợp bằng ngôn ngữ tự nhiên thông qua học tăng cường (reinforcement learning).

Đối với công việc bảo mật, nhóm nghiên cứu của Sakana lập luận rằng vai trò kiểm chứng là điểm mấu chốt. Một lỗ hổng tiềm ẩn được phát hiện bởi một tác nhân sẽ được các tác nhân phụ chuyên về bảo mật xác thực trước khi bất kỳ bản vá nào được đề xuất. Cơ chế định tuyến vẫn là thông tin độc quyền, vì vậy bạn không thể biết mô hình nào đã xử lý bước nào.

Quyền truy cập, chính sách và giá cả

Fugu-Cyber bị hạn chế trên bốn phương diện.

Việc truy cập yêu cầu một đơn đăng ký nêu rõ mục đích sử dụng và thông tin liên hệ đã được xác minh. Nhóm Sakana xem xét thủ công từng đơn. Mô hình được phát hành theo Chính sách Sử dụng Chấp nhận được (Acceptable Usage Policy) đã cập nhật, nghiêm cấm việc lạm dụng cho mục đích tấn công. Việc thanh toán bị giới hạn trong Gói Token (Token Plan). Các gói đăng ký 20$, 100$ và 200$ chỉ áp dụng cho Fugu và Fugu-Ultra. Ngoài ra, API Fugu không được cung cấp tại EU hoặc EEA trong khi Sakana đang nỗ lực tuân thủ GDPR.

Giá được ấn định ở mức 6$ cho mỗi triệu token đầu vào, 36$ cho đầu ra và 0,60$ cho đầu vào được lưu trong bộ nhớ đệm (cached input). Cả ba mức giá này sẽ tăng gấp đôi nếu vượt quá ngữ cảnh 272K token. Mỗi dòng giá đều cao hơn 1,2 lần so với mức giá của Fugu-Ultra, tức là phụ phí cố định 20% cho điểm cuối an ninh mạng. Các lần chạy mã nguồn dài thường dễ dàng vượt qua ngưỡng 272K, vì vậy mức giá gấp đôi không phải là trường hợp hiếm gặp.

Những điểm chính cần lưu ý

Asif Razzaq là CEO của Marktechpost Media Inc.. Là một doanh nhân và kỹ sư có tầm nhìn, Asif cam kết khai thác tiềm năng của Trí tuệ nhân tạo vì lợi ích xã hội. Nỗ lực gần đây nhất của ông là ra mắt Nền tảng Truyền thông Trí tuệ nhân tạo, Marktechpost, nổi bật với việc đưa tin chuyên sâu về học máy và học sâu, vừa đảm bảo tính kỹ thuật vừa dễ hiểu đối với đông đảo độc giả. Nền tảng này tự hào với hơn 2 triệu lượt xem mỗi tháng, minh chứng cho sự phổ biến của nó đối với công chúng.

Sakana AIAn ninh mạngFugu-CyberMô hình AIBảo mật
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ MarkTechPost. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.