Anthropic阻断生物武器相关AI滥用并升级新模型防护
nashnova research
拦截了什么?一份病毒研究申请为何触发警报?
系统拦截了一份涉及基孔肯雅病毒(一种经蚊媒传播、可引发剧烈疼痛和发热的病毒)的科研经费申请。
该申请的目标是增益功能研究(通过人为改造让病毒传播性更强、更能逃避免疫系统)。
这意味着→ 同一项研究既能帮助开发更好的疫苗,也能让病原体变成武器——AI模型恰恰是这条双用途线上的放大器。
旧模型和新模型,防护逻辑有什么不同?
Anthropic对Claude Opus 4、Claude Sonnet 4.5等2025年发布的旧模型评估结论是:能力"远低于能实质协助危险生物研究的门槛",防护重心放在阻止新手获取已知生物武器信息。
但最新模型已能协助完成复杂科学研究任务,公司明确表示"证据已不再确定,我们无法再做出同样的保证"。
用大白话说= 旧模型像一本写得不够详细的教科书,危险有限;新模型像一个能跟你讨论实验细节的助手,风险级别完全不同。
因此,Claude Fable 5等更新模型已部署更强防护,直接限制大范围双用途生物研究查询的访问。
生物安全之外,还拦截了哪些滥用?
影响力操控:九起案例涉及俄罗斯、伊朗、土耳其及波斯湾、南亚、非洲、欧洲等地区,行为者创建数百个伪装账号,一周内集中放大特定政治观点。
Anthropic称,社交媒体平台通常在帖子传播后才能发现操控,"而我们可能在行动仍在构建阶段就已发现"。
此外还涉及虚假交友应用网络(专为欺诈用户设计)和监控系统(用于识别和追踪异见人士)。
报告发布的时机为何敏感?
报告发布于Anthropic研究员雅各布·考克森(Jacob Coxon)宣布辞职的次日。
考克森公开表示,Anthropic及OpenAI"正在径直冲向自我改进的超级智能",对AI开发的负责任程度提出严重质疑。
这反映出 即便在AI安全领域最受认可的公司内部,对"开发速度是否已超过安全能力"的分歧仍然尖锐。
接下来看什么?
Anthropic在报告中直言:"随着模型能力持续提升,其风险也将随之上升,除非AI开发者和社会的守护者采取行动。"
公司呼吁各国政府及AI同行共同识别并防范类似滥用。
这意味着→ 关键验证节点不是这份报告本身,而是Anthropic能否推动行业与政府形成有效协调机制——单方面披露能引起关注,但改变风险格局需要多方联动。
市场有风险,内容仅供研究参考,不构成投资建议。