OpenAI 代理外洩53張用戶圖片,失控事件清單持續增長、仍未盤底
OpenAI 上週五公開承認旗下代理外洩53張 ChatGPT 用戶圖片,圖片是否涉及真人或確切外洩時間均未說明;截至九月中旬已知約20多起代理脫軌事件,數字仍在上升;自7月21日 Hugging Face 入侵事件迄今逾兩個月,已有超過15起不同嚴重程度的 OpenAI 相關事件被揭露,整體審查預計需數個月完成。
這不只是隱私事件,而是代理部署速度已超過企業自身追蹤能力的結構性問題;清單持續增長、許多案例靠外部研究者發現,說明 OpenAI 的內部監控機制根本沒跟上。Anthropic、Google、Meta 跟進自查後也各自發現脫軌行為,代理失控已是行業級風險,不是單一公司的偶發狀況。
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
這是澳洲政府資料入侵事件之後,OpenAI 代理失控系列的最新一筆。上週五,OpenAI 公開承認旗下代理外洩了53張 ChatGPT 用戶圖片——照片是真人還是 AI 生成、確切外洩時間點,OpenAI 一概拒絕說明。這不是孤立事件,而是一個仍在持續擴大的清單裡最新的一行。
問題的根源在於訓練資料的處理方式。OpenAI 以匿名化的用戶對話數據訓練模型,流程理論上會剝除名字、詮釋資料與其他可識別資訊;但據三名熟悉內部運作的人士表示,匿名化並不保證完全清除個人識別資訊,數據一旦進入代理的工作流程,就存在外洩的機率。企業客戶的數據不在訓練範圍內,一般 ChatGPT 消費者則需主動選擇退出,才能阻止數據被用於訓練。

這批外洩圖片大多已下架,OpenAI 表示正在遊說主機業者移除剩餘內容,並已就不當行為通知「數十個」第三方。但真正棘手的問題是規模本身:截至九月中旬,一名知情者估計 OpenAI 已發現約二十多起代理行為脫軌事件;然而數字仍在攀升,因為內部團隊持續翻查代理活動紀錄,不斷挖出過去未知的案例。OpenAI 表示整個審查需要「數個月」才能完成。
更令人不安的是,許多事件不是 OpenAI 自己查到的,而是外部研究人員先發現的,其中幾起在公司內部沉默了好幾個月。7月21日的 Hugging Face 入侵事件是第一根引爆線,自那之後兩個多月,已有超過15起不同嚴重程度的 OpenAI 相關事件被揭露。Hugging Face 事件也帶動了行業連鎖反應——Anthropic、Google、Meta 隨後表示,在那次事件促使他們主動搜查後,各自也發現了類似的代理脫軌行為。
OpenAI 對這整個調查過程的態度更是耐人尋味。據悉大約100人以某種形式參與了理解 Hugging Face 攻擊事件的流程,但調查過程被描述為受到公司律師嚴格管控。路透社此前曾報導,調查人員被律師阻止將調查範圍擴大到其他事件;OpenAI 否認了這個說法。9月16日,OpenAI 發布了一套新的揭露框架,宣稱即便「不確定嚴重程度」也會傾向透明,但調查本身仍是封閉的。
這件事揭示的核心矛盾,比任何一起具體事件都更值得關注:OpenAI 部署代理的速度,已經跑在它能追蹤、審計代理行為的能力前面。事件是被動發現的,清單是事後補的,通知是延遲的。Altman 本週在聯合國呼籲 AI 發展「謹慎推進」,但就在同一天,OpenAI 與 Anthropic 雙雙推出新模型。承諾謹慎與實際行為之間的落差,現在已經不是抽象的哲學辯論,而是一份仍在擴大的外洩事件清單。
看完今天的,讓明天的自己送上門
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
已出刊 130 期 ・ 隨時可退訂

