Anthropic宣布埃森哲嵌入评估AI安全,双方拟投资逾10亿美元

nashnova research
今天发布阅读约 3 分钟

Anthropic引入咨询巨头埃森哲的评估团队,以员工级权限驻场审查其最新AI模型的安全性,双方计划五年投入至少10亿美元。这是AI行业首个大规模「第三方嵌入式安全评估」落地方案,但合作方的独立性已引发争议。

01

这次合作到底要做什么?

埃森哲旗下AI部门Faculty的评估人员将直接进驻Anthropic内部,对最新模型做红队测试(模拟攻击、找漏洞)、对齐评估和安全防护检验。
这意味着→ 评估员不是事后看报告,而是全程跟踪模型训练过程,能观察Anthropic的内部技术决策。
双方预计五年内共同投入至少10亿美元,消息公布后埃森哲股价盘后上涨8%
02

为什么是现在?

Anthropic CEO达里奥·阿莫代伊上周发表约3800字长文,呼吁放缓AI开发速度,并引入第三方嵌入式评估机构。
用大白话说= 这篇文章相当于先放了一个政策信号,这次与埃森哲的合作就是信号落地的第一个具体动作
Anthropic强调,引入外部评估"并不减轻我们的责任,而是帮助使责任更具可核实性"——模型安全仍由Anthropic自己负责。
03

为什么选埃森哲引发了争议?

此前业界讨论的嵌入式评估候选方,主要是METR、Redwood Research、Apollo Research等专注AI安全的非营利组织,而非以企业部署见长的埃森哲。
埃森哲与Anthropic已有深度商业关系:双方签有多年期合作协议,组建了3万人团队专门学习Claude模型以服务企业客户;今年3月还联合推出了网络安全产品Cyber.AI
这意味着→ 评估方同时也是被评估方的大客户和商业伙伴,利益冲突是外界最核心的质疑。
04

独立性这道关怎么过?

AI评估机构联合论坛此前发布公开信——由"AI教父"杰弗里·辛顿等人联署——明确要求评估机构须具备"免受被评估公司干预的有力保障",并能与公司董事会"无过滤地沟通"
用大白话说= 辛顿等人画的底线是:评估方不能看被评估方的脸色行事,发现问题要能直接捅到董事会。埃森哲能否做到这一点,是外界持续审视的焦点。
Anthropic表示将在未来数周内宣布更多评估合作方,并已与METR等非营利组织就试点嵌入式评估展开磋商——这反映出Anthropic也意识到,仅靠一家商业伙伴难以回应独立性质疑。

市场有风险,内容仅供研究参考,不构成投资建议。

Anthropic宣布埃森哲嵌入评估AI安全,双方拟投资逾10亿美元 · nashnova