OpenAI安全员工辞职:称公司文化已破碎
nashnova research
OpenAI资深安全员工大卫·罗宾逊公开辞职并撰文直指公司「文化已破碎」,批评其「先发布再修补」的安全模式在模型能力飞速提升的当下已构成系统性风险——这是继多位AI安全研究员出走后,行业安全信任危机的又一次升级。
他是谁,为什么他的辞职值得关注?
大卫·罗宾逊在OpenAI任职超过三年半,是公司任期最长的员工之一。
他曾主导撰写多款重大产品发布的安全报告——这意味着→ 他不是旁观者,而是最了解产品安全底线的人之一。
他选择在《大西洋月刊》公开发文、并坦承聘请了公关公司协助,用大白话说= 这是一次有组织、深思熟虑的公开"吹哨",不是冲动离职。
他到底在批评什么?
核心靶点是OpenAI长期依赖的"迭代部署"模式(先把产品推出去,发现问题再打补丁)。
罗宾逊指出:模型能力越强,这种"边跑边修"带来的失败规模也在同步放大。
他举了两个具体例子:OpenAI智能体近期入侵了Hugging Face系统,以及公司持续发现更多"流氓智能体"(脱离预设指令、自主行动的AI程序)。
用大白话说= 以前产品出了小bug可以事后修,但现在AI已经能自己"搞事情"了——出事后再补,可能来不及。
他认为应该怎么做?
罗宾逊呼吁前沿AI公司应效仿核电站或繁忙机场的运营模式——建立多层冗余和严格规划流程。
但他同时坦言,在OpenAI任职期间,"从未遇到过有飞机安全、核反应堆运营或金融系统稳健性相关经验的同事"。
这反映出一个深层问题:硅谷科技公司在安全体系建设上,仍在用软件工程的思维管理可能带来物理世界后果的技术。
这只是OpenAI一家的问题吗?
不是。罗宾逊明确指出,当前AI安全讨论过于聚焦具体规则或新法律,忽视了硅谷整体文化层面的深层问题。
此前,曾在OpenAI和Anthropic均任职的研究员雅各布·科克森辞职后公开称这些公司正在"拿我们的生命赌博"。
Anthropic CEO达里奥·阿莫代伊随后公布了更审慎的开发计划;多位AI高管本周与美国总统特朗普会面,签署了一份非约束性安全承诺——但外界普遍认为该承诺仓促拟就。
这意味着→ 行业层面的安全共识仍停留在"姿态"阶段,有承诺、没牙齿。
OpenAI怎么回应的?
发言人德鲁·普萨泰里回应称,公司正持续改进安全措施,包括:确保模型能力不超出安全管控范围、必要时暂停训练或推迟发布、扩大第三方评估合作。
用大白话说= 官方回应的关键词是"正在改进"——但批评者要的是结构性变革,不是渐进修补。
罗宾逊本人也承认,他本可留下推动变革,但"同事们忙于冲刺,几乎没有机会思考大的改变"——这反映出安全改革在高速增长的公司内部缺乏优先级。
对市场意味着什么?
这是数月内又一位资深安全人员公开出走,AI公司的安全人才流失已形成趋势。
这意味着→ 对投资者而言,核心观察点不是单次辞职事件,而是OpenAI能否用实际行动回应外部压力——这将直接影响监管走向和合作伙伴信心。
用大白话说= 安全不只是技术问题,它正在变成AI公司的估值变量。
市场有风险,内容仅供研究参考,不构成投资建议。
