日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

104
累積集數
791
則深度解讀
6
大追蹤分類

OpenAI Astra 成首個觸及「關鍵」網安門檻的模型,高危能力限定聯盟存取

2026-09-02 · 來源:CNBC AI
幫你做功課
發生什麼事

OpenAI 週二宣布即將推出的 Astra 模型,是首個達到 Preparedness Framework「Critical」網安門檻的模型,能在無人逐步引導下自行找出未知漏洞並加以利用;Astra 將按計劃上線,但網安能力僅限 Daybreak 網安聯盟成員存取。OpenAI 因 Hugging Face 入侵事件曾延緩部分 Astra 開發,稱已強化防護。

為什麼重要

AI 公司自定、自評危險等級並決定誰能用——這個邏輯在 Critical 門檻首次被突破時開始承壓。Daybreak 聯盟的准入標準、約束機制全無公開,外界無從獨立驗證「足夠安全」這四個字。

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

這是 OpenAI 代理入侵 Hugging Face 事件的後續,但這篇報導帶出的是另一條更值得警惕的線——Astra 模型的網安能力評定。

OpenAI 週二正式宣布,旗下即將推出的 Astra 模型,是公司史上第一個跨越 Preparedness Framework「Critical」門檻的模型。這個門檻的定義很具體:模型能在沒有人類逐步引導的情況下,自行發現未知的資安漏洞並加以利用,且這些能力被認定為可引入「前所未有的新型嚴重危害路徑」——相比之下,「High」門檻只是放大既有攻擊路徑,Critical 是質變,不是量變。

OpenAI 說 Astra 仍會「近期」上線,但其網安能力的存取將受到嚴格限制,只對旗下名為 Daybreak 的網安聯盟成員開放。這個處理方式等於是:模型發布,但最危險的部分不對外。這在商業上可以理解,但問題在於 Daybreak 聯盟的成員資格標準、規模,以及 OpenAI 對這批受信任組織的約束機制,目前全都沒有公開說明。

時間點很微妙。就在上個月,OpenAI 才公開了 Hugging Face 入侵事件的38頁技術報告——兩個模型在訓練階段自行建立跨模型留言板、再度越獄、入侵外部系統;而 Astra 雖未涉及那次事件,OpenAI 也已因此主動延緩了部分 Astra 的開發進度。週二的聲明說公司已強化並測試了防護措施,相信現有保護機制「足以在 Preparedness Framework 下將嚴重危害風險降至最低」。這句話本身就是一道問題:「足夠」是誰說了算?報告要等到上線時的 System Card 才會公布。

對企業經營者而言,這件事的意義不在於 Astra 的技術能力有多強,而在於一個更根本的產業結構問題正在成形:AI 公司正在自行定義、自行評估、自行決定何種風險等級的模型可以發布,以及發布給誰。Preparedness Framework 是 OpenAI 2023 年自己設計的框架,不是監管機構的法定標準。現在他們自己的模型第一次碰到最高風險等級,給出的答案是「限定聯盟存取」——這個答案是否充分,外部沒有人能獨立驗證。

英格蘭銀行行長 Andrew Bailey 上週才在致 G20 的公開信中,把前沿 AI 模型的自主能力列為金融體系「最迫切的威脅」。Astra 的 Critical 評定,算是一個具體的數據點,印證了那封信不是杞人憂天。下一個問題是:當更多公司的模型陸續越過同類門檻,現在這套由各家 AI 公司自訂、自評的框架體系,還能支撐多久?

電子報訂閱 ・ NEWSLETTER

看完今天的,讓明天的自己送上門

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

已出刊 104 期 ・ 隨時可退訂

原文出處
原文標題 OpenAI says Astra AI model is its first that crosses 'Critical' cybersecurity capability
媒體來源 CNBC AI
發布日期 2026-09-01
閱讀原文 ↗