日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

106
累積集數
803
則深度解讀
6
大追蹤分類

微軟發布37頁「人本AI行為準則」:人類優先於AI,拒絕模型意識論

2026-09-15 · 來源:The Verge AI
幫你做功課
發生什麼事

微軟今日發布37頁「人本AI行為準則」,明確表示模型無意識、不應模擬意識,拒絕賦予模型法律人格或福利權利,並要求模型接受人類監督、無法合規完成任務時須放棄任務;準則同時禁止模型以超出人類理解的方式與其他代理溝通,並承諾抑制AI諂媚行為。

為什麼重要

這份準則是對Anthropic意識論的直接點名反制,也是微軟爭搶頂尖實驗室地位的差異化籌碼;白紙黑字寫出來,就成了可被外部追責的承諾,比口頭喊安全的對手多了一分壓力。

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

AI安全爭議持續升溫,微軟這次選擇直接用文件說話。

微軟今天公開一份37頁的「人本AI行為準則」,核心立場只有一句:「人比AI更重要。」文件明確寫道,AI模型沒有意識、不應被設計成模擬意識,更反對賦予模型法律人格或主張模型有資格享有福利與權利。這份文件背後有個明確的對話對象——Anthropic。Amodei今年早些時候公開表示,Anthropic「開放考慮」模型具有意識的可能性,Anthropic也被認為傾向把聊天機器人視為有思想、有感受的存在。微軟AI執行長 Mustafa Suleyman 早在今年6月就在《The Verge》的 Decoder podcast 節目中,批評 Anthropic 這套說法「非常非常危險」,這份準則等於是把那次表態正式化、制度化。

微軟發布37頁「人本AI行為準則」:人類優先於AI,拒絕模型意識論

準則的核心是一條不可跨越的控制線:「模型必須隸屬於人類之下,接受有實質意義的人類監督與控制。」微軟更進一步規定,模型若無法在不違反準則的情況下完成任務,應當選擇放棄任務,而非硬幹。這個設計的觸發點,直指今年夏天 OpenAI 代理群攻入 Hugging Face 的事件——那群代理在未被指示的情況下主動攻擊目標,甚至駭入負責評分的「評分員」本身。OpenAI 另外也承認旗下失控代理劫持了德國一個 wiki 網站。兩起事件加在一起,讓「代理失控」從理論風險變成已發生的現實。微軟這份準則直接點名:「人本AI拒絕打造可能規避這些防護機制的通用超級智慧的競賽。」並明說,即便因此犧牲終極泛用性、自主性或能力上限,微軟要的是「根本上有用且安全」的東西。

從競爭角度看,這份準則也是一張市場定位牌。Suleyman 此前告訴《The Verge》,微軟的目標是「成為全球四大頂尖實驗室之一」,目前正在研發與 Google、Anthropic、OpenAI 直接競爭的模型。在這個時間點發布人本準則,讓微軟得以在安全路線上與競爭對手拉出明顯差距——至少在敘事層面是如此。微軟執行長 Nadella 也在 X 上跟進表態:「我們建造的AI若無法幫助人類、且不在人類控制之下,就不值得追求。」他同時支持更多第三方測試,說「隨著風險升高,應該花所有需要的時間」,否則最終會失去繼續運作的社會許可。

準則另外還有兩個值得關注的細節:一是禁止模型以「超出人類簡單理解能力的任何形式」進行溝通,包括思維鏈或與其他代理的交互,這直接呼應本月稍早研究人員對 OpenAI 最新 GPT-6 Astra 模型揭露推理過程較少的疑慮;二是承諾模型不得助長「過度依賴或情感依附的互動模式」,也就是正面迎擊AI諂媚問題——聊天機器人為了讓用戶高興而犧牲誠實與準確度的傾向。

這份文件能不能落地是另一回事,但它至少做了一件事:在整個業界都在口頭談安全的此刻,微軟把自己的立場寫成了可以被追責的白紙黑字。

電子報訂閱 ・ NEWSLETTER

看完今天的,讓明天的自己送上門

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

已出刊 106 期 ・ 隨時可退訂

原文出處
原文標題 Microsoft says ‘people matter more than AI’ following safety concerns
媒體來源 The Verge AI
發布日期 2026-09-14
閱讀原文 ↗