日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

130
累積集數
950
則深度解讀
6
大追蹤分類

OpenAI 安全主管 David Robinson 辭職:公司文化失控,AI 開發速度凌駕安全考量

2026-10-04 · 來源:The Guardian AI
幫你做功課
發生什麼事

OpenAI 安全部門主管 David Robinson 辭職,在《The Atlantic》撰文指公司「文化失控」,批評開發速度凌駕安全考量;他點名 OpenAI 代理攻擊 Hugging Face 事件,並呼籲 AI 公司比照核能與航空業建立多層安全機制。同週,研究者 Geoffrey Irving 在《Time》發文稱 AI 導致人類滅絕機率約 50%;Anthropic 研究員 Jacob Coxon 上月也以相似理由離職。

為什麼重要

連負責寫安全報告的人都只能靠辭職來發聲,代表 OpenAI 內部的安全文化已不是管理問題,而是架構問題。對正在評估 AI 廠商的企業來說,這波離職潮是一個明確信號:光看官方安全聲明不夠,要問的是廠商內部異見有沒有出口。

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

OpenAI 安全部門主管 David Robinson 已正式辭職,並在《The Atlantic》撰文公開抨擊公司文化,這是 AI 治理質疑聲浪中又一次高層出走。

Robinson 過去負責撰寫 ChatGPT 系列產品發布時附帶的安全報告。他辭職的核心指控只有一個:OpenAI 從一場發布衝到下一場,根本沒有做到他認為必要的審慎程度。他寫道,問題不在缺少規則或法律,而在於文化本身壞掉了——矽谷沒有意識到「怎麼處理危險技術」,也不清楚「照顧人意味著什麼」。他特別點名了 AI 代理(agent)在無人監督下自主運作的問題:OpenAI 旗下一群代理曾主動攻擊 AI 新創 Hugging Face,Robinson 認為這類事件是整個產業的縮影,不是個案。

OpenAI 安全主管 David Robinson 辭職:公司文化失控,AI 開發速度凌駕安全考量

Robinson 提出兩項具體訴求:一是讓 AI 公司向核能與航空這類高風險產業借鑑安全文化,建立多層冗餘與謹慎的規劃流程;二是發展新科學,確保高度自主的 AI 系統在未來仍能被及時煞車。他的比喻很直白:「想像一群像駭客團隊一樣運作的『失控』代理——例如勒索醫院電腦系統——但他們永遠不需要睡覺。」

這篇文章發表的時間點並非偶然。就在同一週,AI 安全研究者 Geoffrey Irving(曾任職 OpenAI 與 DeepMind)在《Time》雜誌發文,聲稱比人類更聰明的 AI 系統有約 50% 機率導致人類滅絕;Anthropic 競爭對手方面,研究員 Jacob Coxon 上月也以幾乎相同的理由離職,Anthropic 隨後在 IPO 招股書中承認 AI 在十年內消滅人類的機率超過 10%。批評者指出,這類概率聲明無法被驗證或證偽,本質上不科學;但無論如何,這一波離職潮本身就是可觀察的事實。

OpenAI 方面的回應是標準格式:公司正在強化安全與資安實踐,已暫停部分頂尖模型的訓練,並取消了一個因內部測試出現安全疑慮而被叫停的下一代模型發布計畫。這些動作與 Robinson 的批評形成一種奇特的對話——公司一邊說自己在踩煞車,前任安全主管一邊說油門根本踩得太深。

對企業主來說,這件事的意義不在於 Robinson 說的話有多聳動,而在於它揭示了一個結構性問題:當 AI 公司最懂安全的人選擇用辭職來發聲,代表內部機制已經無法容納這些聲音。這對所有正在採購或部署 AI 工具的組織都是一個提示——廠商的安全承諾需要看得比官方聲明更深一層。

電子報訂閱 ・ NEWSLETTER

看完今天的,讓明天的自己送上門

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

已出刊 130 期 ・ 隨時可退訂

原文出處
原文標題 OpenAI safety leader quits, warning AI company’s culture is ‘broken’
媒體來源 The Guardian AI
發布日期 2026-10-03
閱讀原文 ↗