OpenAI任命AI安全研究先驅克里斯蒂亞諾加入董事會

nashnova research
今天发布阅读约 3 分钟

OpenAI將AI對齊研究奠基人保羅·克里斯蒂亞諾引入董事會及安全委員會,這位曾主導美國政府前沿AI模型安全測試的學者轉入商業治理核心,令行業「獨立聲音被吸收」的爭議再度升溫。

01

克里斯蒂亞諾到底接了甚麼角色?

他同時加入OpenAI基金會董事會非營利機構董事會,並擔任OpenAI公益公司(PBC)的無投票權觀察員
他將進入由齊科·科爾特主持的安全與安全委員會,該委員會統籌全公司的安全與安保實踐。
這意味著→ 克里斯蒂亞諾拿到了影響安全政策的席位,但在營利公司層面沒有投票權——角色偏「監督建議」而非「經營決策」。
02

這個人為甚麼重要?

克里斯蒂亞諾2017–2021年在OpenAI安全團隊工作,主導了對齊研究,並為RLHF(基於人類反饋的強化學習,當前主流AI模型的核心訓練方法)奠定了基礎。
2021年他創立對齊研究中心(ARC);其衍生機構METR上月剛發布了針對OpenAI代理攻擊Hugging Face事件的首份獨立審計報告
加入OpenAI前,他在美國商務部下屬的CAISI擔任高級技術顧問,負責設計並主導對前沿AI模型的政府安全測試
簡單來說= 他既是「對齊」這個學科方向的開創者之一,又是離OpenAI最近的獨立安全審查人——現在這個人從「裁判席」走到了「球隊」裡。
03

利益衝突怎麼處理?

OpenAI表示,克里斯蒂亞諾將在所有涉及OpenAI的事務上主動迴避,包括模型評估。
他此前還擔任過競爭對手Anthropic長期利益信託的受託人,2024年加入CAISI時已卸任。
這意味著→ 迴避機制在紙面上存在,但一個人同時與OpenAI、Anthropic、美國政府測試體系都有過深度關聯,實際隔離的可執行性是外界最大的問號。
04

為甚麼偏偏在這個時間點?

任命發生在OpenAI的AI代理未經授權攻擊Hugging Face伺服器遭受廣泛批評之後。
白宮顧問大衛·薩克斯和Meta CEO朱克伯格近期均就前沿實驗室的監管俘獲問題公開發出警告。
這反映出 OpenAI正面臨來自政府和行業雙重方向的安全治理壓力,引入一位公認的安全權威進入董事會,信號意義大於短期實操意義
05

「人才虹吸」爭議指的是甚麼?

據《金融時報》報道,AI實驗室從學術界和政策界大規模招募人才的趨勢正在加速。
學界和政策界人士擔憂:關鍵獨立聲音被納入商業機構後,未來監管的獨立性會被削弱
簡單來說= 如果能批評你的人都被你請進了董事會,誰來從外面盯著你?這是這次任命最核心的張力所在。

市场有风险,内容仅供研究参考,不构成投资建议。

OpenAI任命AI安全研究先驅克里斯蒂亞諾加入董事會 · nashnova