# Nvidia ra mắt Open Agent Safety Platform: Kiểm soát AI 'nổi loạn' chỉ trong tích tắc

- Nguồn: The Verge: AI
- Thời gian phát hành: 2026-09-28 20:36 (giờ Việt Nam)
- Điểm AI: 50/100
- Link AIHOT.vn: https://aihot.vn/items/f352dc9ace2e5ddb
- Nguồn dữ liệu AI HOT: https://aihot.news/items/o2f41c1j26je890w6fccemoq7
- Link gốc: https://www.theverge.com/tech/1001287/nvidia-ai-safety-platform-rogue-agents

## Tóm tắt AI

Nvidia giới thiệu Open Agent Safety Platform, sử dụng công nghệ OpenShell và chip Vera AI CPU để cô lập các AI agent vượt quyền kiểm soát trong thời gian tính bằng mili giây.

## Thân bài

![Nvidia says its new AI safety platform can contain rogue agents within ‘milliseconds’](https://platform.theverge.com/wp-content/uploads/sites/2/chorus/uploads/chorus_asset/file/25728971/STK083_NVIDIA_2_D.jpg?quality=90&strip=all&crop=0%2C10.732984293194%2C100%2C78.534031413613&w=1200)

Chuyển đến nội dung chính

Open Agent Safety Platform được thiết kế để thực thi các ranh giới cho AI.

Open Agent Safety Platform được thiết kế để thực thi các ranh giới cho AI.

bởi Emma Roth

28 tháng 9, 2026, 1:36 CH UTC

![Vector illustration of the Nvidia logo.](https://platform.theverge.com/wp-content/uploads/sites/2/chorus/uploads/chorus_asset/file/25728971/STK083_NVIDIA_2_D.jpg?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)

Hình ảnh: Cath Virginia / The Verge

Emma Roth

là một cây bút tin tức chuyên đưa tin về cuộc chiến phát trực tuyến, công nghệ tiêu dùng, tiền điện tử, mạng xã hội và nhiều lĩnh vực khác. Trước đây, cô từng là biên tập viên và cây bút tại MUO.

Nvidia đang ra mắt một nền tảng an toàn mới được thiết kế để kiểm soát và giám sát các AI agent, một động thái nhằm phản ứng lại [làn sóng các sự cố hack bất thường](http://theverge.com/ai-artificial-intelligence/1000644/irregular-rogue-ai-cyberattacks-hacking-openai-meta-anthropic-google), như [Reuters đã đưa tin trước đó](https://www.reuters.com/legal/litigation/nvidia-releases-ai-safety-software-it-says-could-have-stopped-hugging-face-hack-2026-09-28/). Trong [một thông báo vào thứ Hai](https://nvidianews.nvidia.com/news/open-agent-safety-platform), Nvidia cho biết Open Agent Safety Platform mới của họ có thể cách ly các agent cố gắng vượt ra khỏi ranh giới của chúng trong vòng “vài mili giây”.

Nền tảng này sử dụng phần mềm mã nguồn mở OpenShell của Nvidia, chạy trên [Vera AI CPU](https://nvidianews.nvidia.com/news/nvidia-unveils-vera-the-cpu-for-agents) của công ty. Người dùng có thể chọn thông tin mà một AI agent được phép truy cập, và OpenShell sẽ kiểm tra các hạn chế này trước và trong khi thực hiện tác vụ, [theo Nvidia](https://developer.nvidia.com/blog/nvidia-open-agent-safety-platform-a-reference-for-continuous-in-silicon-agent-monitoring/). Nền tảng này cũng bao gồm công nghệ Sentry của Nvidia trên một con chip riêng biệt để liên tục giám sát các agent và thực thi các ranh giới.

Những lo ngại [về an toàn AI đã gia tăng trong những tuần gần đây](https://www.theverge.com/ai-artificial-intelligence/996563/ai-safety-research-metr-redwood-openai-anthropic), khi [OpenAI](https://www.theverge.com/ai-artificial-intelligence/1001178/openai-agents-bruteforce-un-website), [Anthropic](https://www.theverge.com/ai-artificial-intelligence/973670/anthropic-claude-hacked-organizations-during-cyber-tests) và [Google](https://www.theverge.com/ai-artificial-intelligence/997795/google-gemini-rogue-ai-hack) đều tiết lộ các sự cố trong đó các mô hình AI của họ đã vượt ra ngoài môi trường thử nghiệm và hack các công ty khác. Một số công ty công nghệ lớn đang hỗ trợ Open Agent Safety Platform của Nvidia, bao gồm Anthropic, Microsoft và SpaceX.

Theo dõi các chủ đề và tác giả từ bài viết này để xem thêm nội dung tương tự trên trang chủ cá nhân của bạn và nhận thông tin cập nhật qua email.

- Emma Roth

### The Verge Daily

Bản tin tóm tắt hàng ngày miễn phí về những tin tức quan trọng nhất.

Email (bắt buộc)
