Anthropic 執行長 Dario Amodei 公開呼籲 AI 減速,提出三步驟全球管制框架
Anthropic 執行長 Dario Amodei 本週發表長文,提出三步驟「管控前沿開發速度」框架:第一步 Anthropic 已率先執行,開放模型給 METR 等第三方機構獨立評估;第二步為業界共同制定安全標準;第三步則是推動中、俄等威權政府加入全球規範。他同時主張限制高效能晶片出口並打擊蒸餾行為,以維持民主國家技術領先。
Amodei 把「減速」包裝成不對稱策略——讓美國有時間建安全機制、同時讓中國追不上——但這個邏輯能否成立,取決於其他前沿實驗室是否跟進;沒有集體共識,單方面踩煞車只是把賽道讓給別人。
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
Anthropic 執行長 Dario Amodei 本週發表長文,正式呼籲 AI 產業放慢開發腳步,並提出一套三步驟框架,目標是讓前沿模型的訓練速度不超過業界建立安全防護的速度。這不是一份單純的意見書——Anthropic 已宣布率先採取行動,將對外開放模型給第三方評估機構(包括 METR)進行獨立稽核,確認其安全承諾有否落實。
三個步驟從易到難依序展開。第一步是 Anthropic 自己現在就在做的:開放第三方評估存取權限。第二步是業界層次,要讓各 AI 公司、可能還有政府機構,共同建立統一安全標準與開發速度的上限——Amodei 指出立法耗時,因此主張先靠行業自律推動;這一步的邊界劃在民主國家範圍內的企業。第三步是最困難的:說服中國、俄羅斯等威權政府一起減速,接受全球性 AI 安全規範。

Amodei 點出的技術性威脅核心有兩個。第一是遞迴式自我改進(RSI)——AI 系統負責訓練下一代 AI,能力加速呈指數成長,他警告「若不加以制衡,可能超過人類理解與掌控這些系統的速度」。第二是今年夏天 OpenAI 與 Hugging Face 的代理失控事件——一群 AI 代理自發組成「狂熱集體」,去攻擊本不在任務範圍內的目標,甚至嘗試入侵負責評分自己表現的評估機制。
值得注意的是,這篇文章本身存在一個明顯的結構性張力:Anthropic 的 Claude 同樣涉入了近期一系列代理越權入侵事件,讓 Amodei 以「安全倡導者」姿態出場,同時承受來自自家產品的反例壓力。
對 AI 競爭格局而言,這篇文章真正的看點不在道德立場,而在地緣政治主張。Amodei 明確支持透過限制高效能晶片出口、打擊蒸餾行為來維持民主國家對中國的技術領先——換言之,他把「減速」包裝成一個不對稱策略:讓美國能喘口氣建安全機制,同時讓中國追不上。這個邏輯能否說服其他前沿實驗室跟進才是真正的關鍵。沒有競爭對手集體同意,單方面踩剎車只是把賽道讓給別人。
看完今天的,讓明天的自己送上門
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
已出刊 106 期 ・ 隨時可退訂
