Anthropic 快取降價45%,OpenAI Astra首觸最高風險級別自行管控
- Anthropic 這次快取降價不是讓步,是精準瞄準 agent 工作負載的定價策略——貴的位置沒動,便宜的是重複使用最多的那格,企業算不算得過帳,取決於自己的 agent 到底在燒什麼。
- OpenAI Astra 碰到自家「最高風險」門檻,給的答案是自己管自己的聯盟——AI 公司自訂,自評,自決的風險框架體系,第一次被自己的產品考驗到極限。
- 加州整包 AI 部署層法案壓在一人截止日前,監管重心正式從訓練端向下游應用層移動,但立法追能力曲線的速度,現在看起來仍然不夠快。
這份綜述每天寄一封:6 則要聞+名人訪談
Claude Fable 5.1 的快取讀取單價砍了 75%,降到每百萬 token $0.25——這個數字比標頭的 $10 / $50 報價更重要。對反覆讀取同一份程式碼庫,工具定義,對話歷史的 agent 架構來說,快取消耗才是帳單的大頭,表頭單價幾乎是假的。Anthropic 自己估算,高 agentic 工作負載的有效成本降幅約 45%。同期 GPT-5.6 Sol 促銷輸入價 $4,Google Gemini 3.7 Flash $0.75,Fable 5.1 仍是貴的那一端——貴到這個程度,它賭的是任務完成率夠高,總體工作成本算得過去,而不是靠價格競爭。這步棋聰明的地方在於:它不降表頭,只降重複使用率最高的那一格,讓願意把長時間工作交給 agent 的企業最先感受到好處。問題是多數企業連「一個 agent 跑完一件事要燒多少 token」都還沒有穩定的內部數字,這個折扣對他們而言仍是估算,不是帳單。
同步登場的安全架構 Enterprise Frontier Safeguards,把監控資料留在客戶自己的雲環境,用客戶的加密金鑰,Anthropic 的自動系統分析使用模式,但不直接碰資料。這個設計改變的不只是隱私政策的措辭,而是資料實際落地的位置——對金融,醫療,法律這些受監管行業來說,AI agent 能不能通過內部合規審查,往往卡在這裡,不是模型夠不夠強。Fable 5.1 想賣的,其實是把企業願意把真實系統存取權交給 agent 的那道門檻再往下壓一格。
今天另一件事更值得正視。OpenAI 宣布,即將推出的 Astra 模型是公司史上第一個觸及 Preparedness Framework「Critical」門檻的模型——定義很具體:能在沒有人類逐步引導的情況下,自行發現未知的資安漏洞並加以利用。OpenAI 的處理方式是:模型照常上線,但最危險的能力只對旗下 Daybreak 網安聯盟開放。這個答案在商業邏輯上說得通,問題是 Preparedness Framework 本來就是 OpenAI 2023 年自己設計的框架,不是監管機構的法定標準。現在他們自己的模型第一次碰到最高風險等級,給出的答案是自己劃聯盟,自己管聯盟,外部沒有獨立機制可以驗證「足夠」是什麼意思。上週英格蘭銀行行長 Andrew Bailey 才在致 G20 的公開信裡把前沿 AI 模型的自主能力列為金融體系「最迫切的威脅」,Astra 的 Critical 評定就是最具體的那個數據點。
這兩件事放在一起,指向同一個結構性問題:AI 公司正在一手推出能力更強的 agent,一手設計自己的風險分級框架,再自己決定哪個等級的模型可以發布給誰。加州立法機關昨晚送出整包 AI 部署層法案給州長紐森,內容管的是 agent 送出去之後被拿來做什麼——招募演算法,健保承保決策,心理諮商替代,雇主情緒偵測,9 月 30 日前全看一個人的筆。方向是對的,但真正的問題是:當模型能自行找漏洞,長時間無人值守地跑在企業核心系統上,部署層的事後規範追不追得上訓練端的能力曲線?
OpenAI Astra 成首個觸及「關鍵」網安門檻的模型,高危能力限定聯盟存取
OpenAI 週二宣布即將推出的 Astra 模型,是首個達到 Preparedness Framework「Critical」網安門檻的模型,能在無人逐步引導下自行找出未知漏洞並加以利用;Astra 將按計劃上線,但網安能力僅限 Daybreak 網安聯盟成員存取。OpenAI 因 Hugging Face 入侵事件曾延緩部分 Astra 開發,稱已強化防護。
詳情分析 →Anthropic 發布 Claude Fable 5.1 與 Mythos 5.1:快取成本砍 75%、安全架構同步重組
Anthropic 發布 Claude Fable 5.1 與 Mythos 5.1,兩者為同一底層模型;Fable 5.1 快取讀取費從每百萬 $1.00 降至 $0.25(降 75%),Anthropic 估算高 agentic 工作負載有效成本降約 45%;基本輸入輸出報價維持 $10/$50 不變。同步推出 Enterprise Frontier Safeguards(EFS),讓企業監控資料可存放於自有雲端環境。
詳情分析 →G20科技部長會議:美國力推「卡羅萊納原則」,主張對AI採放手監管
路透社取得預備發言稿:美國科技顧問 Michael Kratsios 將在北卡G20科技部長會議(9/2起兩天)共同主持,倡議各成員國採納「卡羅萊納原則」,對AI採放手監管、避免立新規;SpaceX 執行長馬斯克與前白宮AI顧問 David Sacks 將於首日以視訊出席發言。
詳情分析 →全球AI Token均價跌破1美元,創指數成立以來新低,模型廠商定價權岌岌可危
追蹤全球 AI token 行情的 LLM Token Expenditure Index(Silicon Data 編製)週一跌至 97 美分,創指數去年底成立以來新低,較今年夏季高點腰斬逾半。Syz Group 投資長 Monchau 指出,跌價動力來自中國開源模型(如月之暗面 Kimi K3)低報價、OpenAI 七月底對兩款 GPT-5.6 模型降價,以及各家前沿實驗室推出動態定價方案。Anthropic 與 OpenAI 今年夏天均已秘密提交 IPO 申請。
詳情分析 →加州立法機關一口氣送出整套AI部署層法案,全壓在紐森一人簽署期限前
加州立法機關8月31日會期最後一夜送出整包AI部署層法案,涵蓋招募演算法、健保承保、心理諮商替代、兒童玩具聊天機器人、雇主情緒偵測、客服揭露、AI溯源等領域;其中SB 813(設立州級AI標準與安全委員會)參議院37票對0票通過,SB 903(限制AI替代心理師)40票對0票通過;所有法案須於9月30日前由州長紐森簽署,除具緊急條款者外,一律2027年1月1日生效。
詳情分析 →騰訊AI組織重整完成:從撤銷AI Lab到空降姚順雨,架構集中化後真正的考驗才開始
騰訊今年3月撤銷存續十年的AI Lab,由出生於1998年的前OpenAI研究員姚順雨接掌AI Infra部與基礎模型部,同時兼任CEO/總裁辦公室首席AI科學家,雙線向TEG總裁盧山與騰訊總裁劉熾平匯報。元宝2026年6月月活4984萬,位居QuestMobile榜單第四;WorkBuddy同期PC端月訪問量2097萬,排名第一,超過第二、三名之和。
詳情分析 →看完今天的,讓明天的自己送上門
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
已出刊 104 期 ・ 隨時可退訂
