日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

95
累積集數
738
則深度解讀
6
大追蹤分類
今日焦點 TODAY'S FOCUS 2026-08-14

DeepSeek開源Harness打地基戰,漲價才是真心話

收聽今日焦點
AI DAILY BRIEFING
0:00 / 3:29
今日精選新聞綜述
  1. AI競爭的重心正在從「模型考試分數」移到「跑一次agent要花多少錢,多順」,誰能把重試率和延遲壓下來,誰才真正拿到企業訂單。
  2. DeepSeek同時開源工具鏈又漲價,說明便宜打天下的階段正在結束,下一階段拚的是把開發者黏在自己的agent地基上。
  3. 模型迭代週期壓到以週計算,對企業是雙面刃——成本下降的同時,重新驗證workflow的隱性代價也在上升。

這份綜述每天寄一封:6 則要聞+名人訪談

Google三週內把Gemini Flash又升了一版,性能腰斬式改善,價格砍半;同一天DeepSeek丟出開源Harness搶agent地盤,順手把API價格拉高超過四倍。兩件事擺在一起看,講的其實是同一件事:AI競爭的主戰場,已經從「模型聰不聰明」搬到「跑一次agent工作流要花多少錢,多順」。

先說Google。Gemini 3.6 Flash才上線三週,3.7 Flash就接著來,編碼與agent的benchmark分數幾乎是腰斬式進步,價格卻直接砍半——每百萬輸入0.75美元,輸出3.75美元。這代表什麼?agent這門生意最貴的不是模型笨,是跑起來動不動要人工介入收拾殘局,一直重試。Google這次講的「更少manual oversight,更少retries」,才是真正戳中企業痛點的地方。性能漲,價格砍半,這組合比任何單一分數都值得留意。但代價也在這裡:三週一迭代,意味著你上週調好的prompt和workflow,這週可能又要重新驗證一遍。模型變便宜是好事,迭代速度本身正在變成一種新的隱性成本。

DeepSeek這邊,故事更值得琢磨。V4-Pro轉正式版不稀奇,真正動刀的是開源Harness——一套「萬物皆插件」的agent runtime,模型,工具,沙盒,檔案系統全部可換,直接對標Claude Code和Codex。上線當天GitHub衝上兩萬多星,聲量做得漂亮。但同時間,DeepSeek把自己的API改成尖峰離峰計費,換算下來一百萬輸入加一百萬輸出,尖峰時段直接漲超過四倍。DeepSeek自己說離峰比尖峰便宜一半,這話術要拆開看:便宜的是相對新尖峰價的一半,不是相對現在這個價的一半——這帳不能這樣算。

便宜牌打到頭了,換打生態牌,這步棋看得很清楚。模型好換,接口標準化了誰都能插;但控制agent怎麼推理,怎麼調工具,怎麼在長流程裡維持狀態的那層runtime,換起來要痛得多。DeepSeek開源Harness,等於是想把開發者黏在自己這套地基上,然後在地基之上把單價往上調。這跟過去靠低價衝下載量,衝聲量的打法,是完全反過來的操作。

對已經把DeepSeek接進生產線的團隊,接下來要盤算的不是模型好不好用,是排程要不要避開尖峰,要不要乾脆把開放權重搬回自己機器上跑。更值得留意的是,DeepSeek公布的agent測試成績,部分是在自家Harness的「minimal mode」下跑出來的——這已經不是純模型能力的比較,是模型加軟體層的組合拳。以後看各家agent benchmark,得先問一句:這分數,是模型跑的,還是連著它自己的runtime一起跑的?這問題不問清楚,排行榜看得再熱鬧也是白看。

本日精選新聞DAILY PICKS 今日焦點由以下新聞展開
#01
模型發布 ·美國 ·OpenAI Blog

OpenAI推出Ultrafast推理模式 攜手Cerebras加速GPT-5.6達14倍

OpenAI預告新API服務層Ultrafast,讓GPT-5.6 Sol模型推理速度提升最高14倍,採用Cerebras晶片技術,輸出速度達每秒750個token,目前為預覽階段。

詳情分析 →
#02
模型發布 ·美國 ·Google DeepMind Blog

Google三週內再推新模型:Gemini 3.7 Flash主打編碼與Agent降價一半

Google於Gemini 3.6 Flash發布三週後推出Gemini 3.7 Flash,主打程式碼除錯、網頁開發與知識密集工作;多項benchmark分數明顯提升,定價為每百萬輸入token 0.75美元、輸出3.75美元,是前代價格的一半,即日起適用於Gemini API與Spark個人助理。

詳情分析 →
#03
模型發布 ·中國 ·VentureBeat AI

DeepSeek開源Harness對打Claude Code,API漲價逾十倍

DeepSeek於8月13日發布V4-Pro正式版與開源Harness(dsh),前者強化agent能力並支援OpenAI Responses API與Codex整合;後者採MIT授權、模型工具皆可替換,直攻Claude Code。同時自8月16日起將API改為尖峰/離峰計價,大幅調漲。

詳情分析 →
#04
模型發布 ·全球 ·CNBC

Meta、輝達接連開源模型,回應中國實驗室主導開放權重賽局

Meta 週一發布開源模型 Muse Spark 1.2、Muse Glimmer,輝達週二發布 Nemotron 3.5 Lightning,兩者權重與訓練方法皆公開下載,呼應上月科技業聯名信籲勿限制中國開放權重模型。

詳情分析 →
#05
投融資 ·全球 ·Ibtimes

Anthropic洽以60億美元收購Decart AI 劍指推理成本壓縮

Anthropic據報洽談收購Nvidia投資的AI新創Decart AI,估值約60億美元,若成交將是Anthropic史上最大收購案;Decart五月才以近40億美元估值完成3億美元融資,談判仍在進行、未必成局。

詳情分析 →
#06
政策法規 ·全球 ·The Guardian AI

台灣通報AI輔助網路攻擊 政府機構帳號遭入侵

台灣數位部證實7月20日起遭境外AI輔助網攻,以色列公司Dream偵測到駭客用開源AI代理打造自主工具,攻破85個政府帳號、竊取逾2500筆人事資料,並擴及核安機關與七家能源公司。

詳情分析 →
電子報訂閱 ・ NEWSLETTER

看完今天的,讓明天的自己送上門

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

已出刊 95 期 ・ 隨時可退訂

近期焦點RECENT FOCUS
09-04輝達129億收購Hugging Face,買的是AI需求情報 09-03美國司法部撐OpenAI版權案,把訴訟說成地緣政治 09-02Anthropic 快取降價45%,OpenAI Astra首觸最高風險級別自行管控 09-01輝達35億押注聯發科,自研晶片時代的遊戲規則寫在NVLink裡 08-31中國記憶體874%暴增,算力租用繞道,管制框架追不上的那一天 08-30索尼華納控告Anthropic,版權攻勢有了新打法 08-29法官撤銷五角大廈黑名單,AI廠商拒絕軍事用途有了先例