Anthropic宣布埃森哲嵌入評估AI安全,雙方擬投資逾10億美元
nashnova research
Anthropic引入諮詢巨頭埃森哲的評估團隊,以員工級權限駐場審查其最新AI模型的安全性,雙方計劃五年投入至少10億美元。這是AI行業首個大規模「第三方嵌入式安全評估」落地方案,但合作方的獨立性已引發爭議。
這次合作到底要做甚麼?
埃森哲旗下AI部門Faculty的評估人員將直接進駐Anthropic內部,對最新模型做紅隊測試(模擬攻擊、找漏洞)、對齊評估和安全防護檢驗。
這意味著→ 評估員不是事後看報告,而是全程跟蹤模型訓練過程,能觀察Anthropic的內部技術決策。
雙方預計五年內共同投入至少10億美元,消息公布後埃森哲股價盤後上漲8%。
為甚麼是現在?
Anthropic CEO達里奧·阿莫代伊上周發表約3,800字長文,呼籲放緩AI開發速度,並引入第三方嵌入式評估機構。
簡單來說= 這篇文章等於先放了一個政策信號,這次與埃森哲的合作就是信號落地的第一個具體動作。
Anthropic強調,引入外部評估「並不減輕我們的責任,而是幫助使責任更具可核實性」——模型安全仍由Anthropic自己負責。
為甚麼選埃森哲引發了爭議?
此前業界討論的嵌入式評估候選方,主要是METR、Redwood Research、Apollo Research等專注AI安全的非牟利組織,而非以企業部署見長的埃森哲。
埃森哲與Anthropic已有深度商業關係:雙方簽有多年期合作協議,組建了3萬人團隊專門學習Claude模型以服務企業客戶;今年3月還聯合推出了網絡安全產品Cyber.AI。
這意味著→ 評估方同時也是被評估方的大客戶和商業夥伴,利益衝突是外界最核心的質疑。
獨立性這道關怎麼過?
AI評估機構聯合論壇此前發表公開信——由「AI教父」傑弗里·辛頓等人聯署——明確要求評估機構須具備「免受被評估公司干預的有力保障」,並能與公司董事會「無過濾地溝通」。
說白了= 辛頓等人劃的底線是:評估方不能看被評估方的臉色行事,發現問題要能直接捅到董事會。埃森哲能否做到這一點,是外界持續審視的焦點。
Anthropic表示將在未來數周內宣布更多評估合作方,並已與METR等非牟利組織就試點嵌入式評估展開磋商——這反映出Anthropic也意識到,僅靠一家商業夥伴難以回應獨立性質疑。
市场有风险,内容仅供研究参考,不构成投资建议。
