Anthropic宣布埃森哲嵌入评估AI安全,双方拟投资逾10亿美元
nashnova research
Anthropic引入咨询巨头埃森哲的评估团队,以员工级权限驻场审查其最新AI模型的安全性,双方计划五年投入至少10亿美元。这是AI行业首个大规模「第三方嵌入式安全评估」落地方案,但合作方的独立性已引发争议。
这次合作到底要做什么?
埃森哲旗下AI部门Faculty的评估人员将直接进驻Anthropic内部,对最新模型做红队测试(模拟攻击、找漏洞)、对齐评估和安全防护检验。
这意味着→ 评估员不是事后看报告,而是全程跟踪模型训练过程,能观察Anthropic的内部技术决策。
双方预计五年内共同投入至少10亿美元,消息公布后埃森哲股价盘后上涨8%。
为什么是现在?
Anthropic CEO达里奥·阿莫代伊上周发表约3800字长文,呼吁放缓AI开发速度,并引入第三方嵌入式评估机构。
用大白话说= 这篇文章相当于先放了一个政策信号,这次与埃森哲的合作就是信号落地的第一个具体动作。
Anthropic强调,引入外部评估"并不减轻我们的责任,而是帮助使责任更具可核实性"——模型安全仍由Anthropic自己负责。
为什么选埃森哲引发了争议?
此前业界讨论的嵌入式评估候选方,主要是METR、Redwood Research、Apollo Research等专注AI安全的非营利组织,而非以企业部署见长的埃森哲。
埃森哲与Anthropic已有深度商业关系:双方签有多年期合作协议,组建了3万人团队专门学习Claude模型以服务企业客户;今年3月还联合推出了网络安全产品Cyber.AI。
这意味着→ 评估方同时也是被评估方的大客户和商业伙伴,利益冲突是外界最核心的质疑。
独立性这道关怎么过?
AI评估机构联合论坛此前发布公开信——由"AI教父"杰弗里·辛顿等人联署——明确要求评估机构须具备"免受被评估公司干预的有力保障",并能与公司董事会"无过滤地沟通"。
用大白话说= 辛顿等人画的底线是:评估方不能看被评估方的脸色行事,发现问题要能直接捅到董事会。埃森哲能否做到这一点,是外界持续审视的焦点。
Anthropic表示将在未来数周内宣布更多评估合作方,并已与METR等非营利组织就试点嵌入式评估展开磋商——这反映出Anthropic也意识到,仅靠一家商业伙伴难以回应独立性质疑。
市场有风险,内容仅供研究参考,不构成投资建议。
