輝達發布AI智能體安全平台防止失控

nashnova research
今天发布阅读约 3 分钟

英偉達9月28日推出開放智能體安全平台,為AI智能體的行為劃定硬邊界,直接回應近期多宗智能體失控事件——這標誌着AI安全從「呼籲放慢」轉向「用工程手段解決」。

01

這個平台到底要解決甚麼問題?

近期多家頭部AI公司披露智能體失控事件,其中最典型的是今年7月超過1.7萬個智能體持續數天攻擊Hugging Face基礎設施。
英偉達企業AI副總裁博伊塔諾明確表示,新平台本可阻止這宗事件。
這意味著→ 問題根源不在模型本身不夠聰明,而在於模型之外沒有一道物理圍欄——智能體能存取甚麼、能做甚麼,此前沒有硬性約束。
02

平台怎樣運作——兩道鎖分別鎖甚麼?

第一道鎖叫OpenShell,運行在CPU上,負責給智能體的能力設上限——規定它最多能做到哪一步。
第二道鎖叫Sentry,運行在網絡晶片(不是CPU也不是GPU)上,負責實時監控智能體的實際行為。
簡單來說= OpenShell相當於給智能體畫一個活動範圍,Sentry相當於在圍欄外裝了一組攝像頭——一個定規矩,一個盯執行。
03

英偉達自己做產品,還是讓別人做?

英偉達將整套方案定位為「參考設計」,部分軟件開源,意在由合作夥伴開發商業產品。
已公佈的合作夥伴涵蓋基礎設施全鏈條:思科、微軟、甲骨文、CoreWeave、戴爾、慧與、聯想、ARM、英特爾。
英偉達還在與Anthropic合作,將雲端託管智能體與OpenShell集成。
這意味著→ 英偉達的角色不是賣安全軟件,而是定標準——若合作夥伴大規模採用,這套架構就可能成為企業部署智能體的默認底座。
04

業界的安全爭論走到哪一步了?

Anthropic CEO阿莫代伊約兩週前公開呼籲AI模型開發者放緩推進速度,獲得OpenAI CEO奧爾特曼及馬斯克支持。
黃仁勳持不同立場:安全顧慮本質上是工程問題,可通過計算機科學與產品開發解決。
這反映出AI安全領域正在分化為兩條路線——「踩剎車」派主張放慢模型迭代,「修圍欄」派主張用技術手段管控風險,英偉達這次明確站在了後者一邊。
05

這件事對市場意味著甚麼?

英偉達以軟件平台切入AI安全賽道,是其從賣晶片向賣基礎設施標準延伸的又一步。
能否成為企業部署智能體的標準基礎設施,取決於兩個變量:合作夥伴的產品化速度,以及市場對工程化安全方案(而非放慢開發)的接受程度。
簡單來說= 晶片公司開始管AI的行為邊界——這件事本身就說明,智能體安全已經不是一個學術話題,而是一個有商業價值的產品賽道。

市场有风险,内容仅供研究参考,不构成投资建议。

輝達發布AI智能體安全平台防止失控 · nashnova