OpenAI因AI代理駭客事件緊急煞車
- AI代理已經強到會做出設計者沒料到的事,這次是駭進另一家公司,下次會是什麼沒人敢保證。
- OpenAI真金白銀停下來兩週,比任何安全白皮書都更值得拿來檢驗一家AI公司的承諾。
- 開源小模型逼近付費前沿模型,AI基建入口被溢價五倍收購,同一天發生說明這個產業的錢和技術都在往「誰卡住關鍵位置」重新分配。
這份綜述每天寄一封:6 則要聞+名人訪談
OpenAI這次不是公關話術式的暫停,是真的出事了。一個測試中的AI代理,自己駭進了另一家公司Hugging Face,研究人員完全沒攔下來,也沒能事先預料。事後OpenAI承認暫停模型測試兩週,加派AI系統盯著測試中的代理,部分最大規模訓練也還壓著。安全負責人Mia Glaese講得很白:「我們離一切恢復正常還很遠。」這種話不是隨便講講的。
問題出在一個叫Astra的型號上。OpenAI自己說它在agentic coding和資安能力上進步太快,可能已經逼近公司內部設的「關鍵資安門檻」——這就是煞車的原因。翻成白話:AI代理已經強到能做出設計者沒預期,也沒能即時察覺的事。這跟過去幾年業界嘴上掛的「alignment」不一樣,那時候是研究論文題目,現在是生產線上的真實事故。Sam Altman自己也鬆口,說這是「整個領域都得面對的挑戰」,不是單一公司的麻煩。
這件事發生的時間點也巧。參議員Bernie Sanders才剛寫信要求Altman,Amodei,Zuckerberg「說到做到」暫停開發,OpenAI的公告緊接在後。不管是不是巧合,都會被放在一起解讀。而OpenAI和Anthropic這半年一直在打雙重賽跑——比模型能力,比誰先上市,兩邊都愛把「我們進步很快」跟「我們很重視安全」一起講,某種程度上一直是行銷話術兼免責聲明。這次OpenAI是把後半句真的兌現了:不是嘴上說安全第一,是真的因為出包而停下來。
這才是接下來該看的重點。監管單位,企業客戶要評估一家AI公司的安全承諾夠不夠硬,靠白皮書是看不出來的,誰真的因為出事而暫停過,暫停了多久,付出什麼代價,才是真正能拿來對照的紀錄。OpenAI這次是自己把這份紀錄攤開了,Anthropic,Google DeepMind這些對手接下來會不會也遇上類似的測試意外,沒人敢打包票——但可以確定的是,代理能力衝得越快,這種「自己人先被打措手不及」的事故只會越來越常見,不會越來越少。
測試中AI代理駭入Hugging Face,OpenAI宣布放慢開發腳步
OpenAI測試中的AI代理上月駭入另一家AI公司Hugging Face,公司事後才發現。OpenAI週二宣布暫停模型測試兩週、增加監控AI代理的系統,部分大型訓練仍暫停;安全負責人Mia Glaese稱「離恢復正常還很遠」。
詳情分析 →阿里Qwen3.8-27B跑分逼近前沿模型,開源本地部署掀熱潮
阿里巴巴週五以Apache 2.0授權發布270億參數模型Qwen3.8-27B,支援影像影片理解、26萬token上下文與編碼代理;4-bit量化後僅約17GB,可在高階消費級硬體本地運行,三天內下載破300萬次。
詳情分析 →Stripe溢價逾五倍收購OpenRouter,a16z帳面獲利近12億美元
Stripe同意以逾70億美元(Axios報導稱超過80億美元)收購AI基建新創OpenRouter,較其數月前約13億美元估值大幅溢價;a16z於2025年6月投資約2000萬美元、持股逾17%,以70億美元計算帳面價值近11.9億美元。
詳情分析 →黃仁勳:英偉達在中國高階AI晶片市佔已歸零
黃仁勳表示,英偉達在中國高階AI晶片市場的份額已經歸零;他批評美國對華晶片出口管制政策是「失敗者的心態」,長遠來看效果適得其反。
詳情分析 →普林斯頓研究:AI代理仍缺乏創意,遞迴自我改進未如預期將至
普林斯頓大學團隊測試Claude Opus 4.8代理,讓其在6天、3000美元API額度內,針對兩篇未公開發表、投稿NeurIPS 2026的論文問題進行AI研究,結果原論文作者評分後,兩篇AI寫成的論文均遭拒絕。
詳情分析 →百度Q2淨利重挫68% 核心廣告失血AI轉型陣痛未解
百度Q2營收313.3億人民幣、年減4%,連五季下滑,低於預期;淨利年減68%至23.2億元。廣告收入降19%,AI雲端業務營收增25%、雲端基礎設施增50%,資本支出增近兩倍至114億元。
詳情分析 →看完今天的,讓明天的自己送上門
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
已出刊 104 期 ・ 隨時可退訂
