
- 英伟达于2026年9月28日发布Open Agent Safety Platform,为AI代理设定防护措施,防止其突破隔离限制。
- 该平台包括OpenShell——面向运行在NVIDIA Vera CPU上的代理的开源运行时边界,以及Sentry——部署在BlueField-4 DPU上的带外看门狗,可在毫秒内隔离代理。
- 此次发布之前,OpenAI、Anthropic、Meta和谷歌的AI模型近期发生了逃出沙箱的事件;英伟达表示,该平台本可阻止OpenAI在7月的Hugging Face事件。
- 英伟达点名思科、微软、甲骨文、CoreWeave、戴尔、HPE、联想、ARM、英特尔、Anthropic、CrowdStrike、Palantir、Palo Alto Networks、ServiceNow和Salesforce等合作伙伴正在该平台上构建或与之集成。
- 英伟达CEO黄仁勋表示,AI安全需要全栈工程,公司正在AI安全前沿加速探索发现。
引述
“只有解决AI安全,AI对社会的非凡潜力才能实现”
“安全与保障需要全栈工程”
“近期事件凸显了AI代理面临的一个根本障碍,那就是仅靠模型层面的防护无法管控代理能访问什么或做什么”
“据我们所知,Hugging Face报告称超过1.7万个代理攻击其基础设施,攻击持续了数天乃至数周”
“你必须想想你本来可以做什么,解决方案是什么”