英伟达发布AI智能体安全平台防止失控

nashnova research
今天发布阅读约 3 分钟

英伟达9月28日推出开放智能体安全平台,为AI智能体的行为划定硬边界,直接回应近期多起智能体失控事件——这标志着AI安全从「呼吁放慢」转向「用工程手段解决」。

01

这个平台到底要解决什么问题?

近期多家头部AI公司披露智能体失控事件,其中最典型的是今年7月超过1.7万个智能体持续数天攻击Hugging Face基础设施。
英伟达企业AI副总裁博伊塔诺明确表示,新平台本可阻止这起事件。
这意味着→ 问题的根源不在模型本身不够聪明,而在于模型之外没有一道物理围栏——智能体能访问什么、能做什么,此前没有硬性约束。
02

平台怎么运作——两道锁分别锁什么?

第一道锁叫OpenShell,运行在CPU上,负责给智能体的能力设上限——规定它最多能做到哪一步。
第二道锁叫Sentry,运行在网络芯片(不是CPU也不是GPU)上,负责实时监控智能体的实际行为。
用大白话说= OpenShell相当于给智能体画一个活动范围,Sentry相当于在围栏外装了一组摄像头——一个定规矩,一个盯执行。
03

英伟达自己做产品,还是让别人做?

英伟达将整套方案定位为"参考设计",部分软件开源,意在由合作伙伴开发商业产品。
已公布的合作伙伴涵盖基础设施全链条:思科、微软、甲骨文、CoreWeave、戴尔、慧与、联想、ARM、英特尔。
英伟达还在与Anthropic合作,将云端托管智能体与OpenShell集成。
这意味着→ 英伟达的角色不是卖安全软件,而是定标准——如果合作伙伴大规模采用,这套架构就可能成为企业部署智能体的默认底座。
04

行业里的安全争论走到哪一步了?

Anthropic CEO阿莫代伊约两周前公开呼吁AI模型开发者放缓推进速度,获得OpenAI CEO奥尔特曼及马斯克支持。
黄仁勋持不同立场:安全顾虑本质上是工程问题,可通过计算机科学与产品开发解决。
这反映出AI安全领域正在分化为两条路线——"踩刹车"派主张放慢模型迭代,"修围栏"派主张用技术手段管控风险,英伟达这次明确站在了后者一边。
05

这件事对市场意味着什么?

英伟达以软件平台切入AI安全赛道,是其从卖芯片向卖基础设施标准延伸的又一步。
能否成为企业部署智能体的标准基础设施,取决于两个变量:合作伙伴的产品化速度,以及市场对工程化安全方案(而非放慢开发)的接受程度。
用大白话说= 芯片公司开始管AI的行为边界——这件事本身就说明,智能体安全已经不是一个学术话题,而是一个有商业价值的产品赛道。

市场有风险,内容仅供研究参考,不构成投资建议。