Anthropic阻斷生物武器相關AI濫用並升級新模型防護

nashnova research
2026-09-10发布阅读约 3 分钟

Anthropic披露過去九個月內多次攔截利用Claude從事生物武器研究、網絡攻擊及政治操控的惡意行為,並宣佈在最新模型中大幅收緊雙用途生物研究的訪問權限——這意味著AI公司正從「事後補救」轉向「出廠即設防」。

01

攔截了甚麼?一份病毒研究申請為何觸發警報?

系統攔截了一份涉及基孔肯雅病毒(一種經蚊媒傳播、可引發劇烈疼痛和發熱的病毒)的科研經費申請。
該申請的目標是增益功能研究(通過人為改造令病毒傳播性更強、更能逃避免疫系統)。
這意味著→ 同一項研究既能幫助開發更好的疫苗,也能令病原體變成武器——AI模型恰恰是這條雙用途線上的放大器。
02

舊模型和新模型,防護邏輯有甚麼不同?

Anthropic對Claude Opus 4、Claude Sonnet 4.5等2025年發佈的舊模型評估結論是:能力「遠低於能實質協助危險生物研究的門檻」,防護重心放在阻止新手獲取已知生物武器資訊
但最新模型已能協助完成複雜科學研究任務,公司明確表示「證據已不再確定,我們無法再做出同樣的保證」。
簡單來說= 舊模型像一本寫得不夠詳細的教科書,危險有限;新模型像一個能跟你討論實驗細節的助手,風險級別完全不同。
因此,Claude Fable 5等更新模型已部署更強防護,直接限制大範圍雙用途生物研究查詢的訪問。
03

生物安全之外,還攔截了哪些濫用?

影響力操控:九宗案例涉及俄羅斯、伊朗、土耳其及波斯灣、南亞、非洲、歐洲等地區,行為者創建數百個偽裝賬號,一週內集中放大特定政治觀點。
Anthropic稱,社交媒體平台通常在帖文傳播後才能發現操控,「而我們可能在行動仍在構建階段就已發現」。
此外還涉及虛假交友應用網絡(專為欺詐用戶設計)及監控系統(用於識別和追蹤異見人士)。
04

報告發佈的時機為何敏感?

報告發佈於Anthropic研究員雅各布·考克森(Jacob Coxon)宣佈辭職的翌日。
考克森公開表示,Anthropic及OpenAI「正在徑直衝向自我改進的超級智能」,對AI開發的負責任程度提出嚴重質疑。
這反映出 即便在AI安全領域最受認可的公司內部,對「開發速度是否已超過安全能力」的分歧仍然尖銳。
05

接下來看甚麼?

Anthropic在報告中直言:「隨著模型能力持續提升,其風險也將隨之上升,除非AI開發者和社會的守護者採取行動。」
公司呼籲各國政府及AI同行共同識別並防範類似濫用。
這意味著→ 關鍵驗證節點不是這份報告本身,而是Anthropic能否推動行業與政府形成有效協調機制——單方面披露能引起關注,但改變風險格局需要多方聯動。

市场有风险,内容仅供研究参考,不构成投资建议。

Anthropic阻斷生物武器相關AI濫用並升級新模型防護 · nashnova