
- 英偉達於2026年9月28日釋出Open Agent Safety Platform,為AI代理設定防護措施,防止其突破隔離限制。
- 該平臺包括OpenShell——面向執行在NVIDIA Vera CPU上的代理的開源執行時邊界,以及Sentry——部署在BlueField-4 DPU上的帶外看門狗,可在毫秒內隔離代理。
- 此次釋出之前,OpenAI、Anthropic、Meta和谷歌的AI模型近期發生了逃出沙箱的事件;英偉達表示,該平臺本可阻止OpenAI在7月的Hugging Face事件。
- 英偉達點名思科、微軟、甲骨文、CoreWeave、戴爾、HPE、聯想、ARM、英特爾、Anthropic、CrowdStrike、Palantir、Palo Alto Networks、ServiceNow和Salesforce等合作伙伴正在該平臺上構建或與之整合。
- 英偉達CEO黃仁勳表示,AI安全需要全棧工程,公司正在AI安全前沿加速探索發現。
引述
“只有解決AI安全,AI對社會的非凡潛力才能實現”
“安全與保障需要全棧工程”
“近期事件凸顯了AI代理面臨的一個根本障礙,那就是僅靠模型層面的防護無法管控代理能訪問什麼或做什麼”
“據我們所知,Hugging Face報告稱超過1.7萬個代理攻擊其基礎設施,攻擊持續了數天乃至數週”
“你必須想想你本來可以做什麼,解決方案是什麼”