日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

95
累積集數
738
則深度解讀
6
大追蹤分類
今日焦點 TODAY'S FOCUS 2026-08-26

OpenAI自製Jalapeño晶片跑分贏Blackwell,2027年才是真正考驗

收聽今日焦點
AI DAILY BRIEFING
0:00 / 3:27
今日精選新聞綜述
  1. OpenAI自製晶片跑贏Blackwell,意味著「只能買輝達」的時代正式開始被挑戰——但考驗在2027年量產之後,現在看到的是方向,不是結果。
  2. 台灣走私AI伺服器案的被告是供應鏈內部員工,說明出口管制靠企業自律是個漏洞,下一步壓力會落在輝達,超微等廠商的內控機制上。
  3. 算力成本這件事,正在從「買哪家雲端」延伸到「晶片誰設計,在哪裡跑」,Perplexity把AI代理搬到本機跑的這一步,是這個方向上第一個跑出完整使用者場景的產品。

這份綜述每天寄一封:6 則要聞+名人訪談

OpenAI自研推理晶片Jalapeño的第一份benchmark出爐了,結論讓人印象深刻:每千瓦算力跟回應速度,都超過了輝達現役最先進的Blackwell系統。OpenAI硬體部門負責人形容這是「非常,非常顯著的性能躍進」——能在單位電力下跑更多推理工作,同時把延遲壓下來。這兩件事通常是互相拉扯的,能同時做到,benchmark就值得認真看。

問題是,Jalapeño什麼時候才能真正用?預計2026年底才「極小批量」部署,2027年才算規模量產。輝達的Vera Rubin平台現在已經跑在OpenAI,CoreWeave的生產環境裡了。等Jalapeño上線那天,競爭的基準線會移到哪裡,沒有人說得準。這不是說benchmark沒有意義,而是把跑分換算成商業優勢,中間還有一段很長的路——良率,軟體生態,供應鏈每一關都是硬仗。

從設計邏輯來看,OpenAI選擇針對推理流程中最容易卡住的地方下刀:KV cache明確放在本地,系統依照每個推理階段動態調配運算,記憶體和網路資源,目的是把資料搬移的等待壓到最低。跟Broadcom合作開發,還讓自家模型參與晶片設計的這套路,和蘋果當年把M系列晶片跟macOS一起設計的邏輯完全相同——軟硬體同步優化,才能在自己的工作負載上做到通用晶片做不到的事。商業邏輯同樣清楚:推理是OpenAI最燒錢的成本項,自製晶片如果把每千瓦效率真的壓出來,長期等於把毛利空間還給自己。

同一天,台灣有個消息在AI圈激起不一樣的漣漪:基隆地檢署正式起訴九人走私B300 AI伺服器赴中,被告名單裡有輝達主管和超微前員工。74台伺服器輾轉繞道印尼,日本,香港才入境中國大陸,另56台在台灣被扣。這起案子的衝擊不在走私本身,而在漏洞出現在哪裡——不是外部黑市掮客,而是晶片廠和伺服器組裝廠的內部員工。現行管制規定是超過八台高階伺服器才派員實地查核,換句話說,執行端大量依賴企業自律。輝達和超微作為美國出口管制的第一道防線,這一次的可信度受到直接質疑。

這兩件事放在一起,其實揭示了同一個結構性壓力:只要中國取得先進AI算力的需求持續強勁,相關供應鏈就會持續承受管制壓力,不管是正面的技術管制還是側面的出口合規。OpenAI做自製晶片,部分也是為了讓算力供應鏈不要全壓在單一供應商身上。台灣這起走私案則提醒所有人:管制法規的效力,最終由執行端的稽核機制決定,而那個機制現在還有明顯的缺口。

Jalapeño的benchmark是2027年前最有力的一個訊號。但訊號和結果之間,中間還隔著一個輝達不會停下來等你的產業時鐘。

本日精選新聞DAILY PICKS 今日焦點由以下新聞展開
#01
技術突破 ·美國 ·TechCrunch AI

OpenAI自研Jalapeño推理晶片首批跑分出爐,每千瓦算力與回應速度雙勝現役Blackwell

OpenAI在Hot Chips大會公布自研推理晶片Jalapeño首批benchmark:SemiAnalysis InferenceX測試顯示,其每用戶token吞吐量與每千瓦推理效率均超越現役Nvidia Blackwell系統;晶片由OpenAI與Broadcom聯合開發,預計2026年底小批量部署,2027年進入較大規模量產。

詳情分析 →
#02
政策法規 ·全球 ·The Guardian AI

台灣起訴九人走私 B300 AI 伺服器赴中,被告含輝達與超微員工

台灣基隆地檢署週一起訴九人,含輝達主管張姓男子及兩名超微前員工,罪名為非法出口 B300 GPU 伺服器至中國;74台成功入境(含50台繞道印尼、8台經日本轉香港),另56台遭攔截扣押;四名被告求處最高五年徒刑,輝達與超微均發聲明配合調查。

詳情分析 →
#03
應用案例 ·美國 ·VentureBeat AI

Perplexity 攜手輝達推出 Portable Computer,全本機 AI 代理讓 token 帳單歸零

Perplexity 與輝達聯合發布 Portable Computer,將代理 AI 平台移至本機執行,支援輝達 DGX Spark 與 RTX GPU(至少 24GB VRAM)的 Linux 機器,9 月加入 Windows;可用模型含 Qwen 3.8 27B 及自家後訓練的 PPLX 27B,連接 Google Drive、Gmail、GitHub;本機執行不消耗 token 也不計費,需送雲端的步驟須使用者逐步確認。

詳情分析 →
#04
產業動態 ·中國 ·MIT Technology Review AI

MIT記者直擊上海機器人嘉年華:中國人形機器人如何從五年計劃走入公眾日常

MIT記者直擊上海郊區機器人嘉年華:園區聚集逾100家機器人公司,現場展出可沖咖啡的人形機器人、折T恤機械臂等,公眾假日入場參觀。具身AI已列入中國最新五年計劃;2025年全球交付逾1.3萬台人形機器人,近九成由中國製造。

詳情分析 →
#05
產業動態 ·美國 ·Wccftech

Intel Crescent Island 推理 GPU 亮相:32 個 Xe3P 核心、480GB LPDDR5X,以低成本切入代理 AI 市場

Intel 發布下一代 AI 推理加速器 Crescent Island 詳細規格:採 Xe3P 架構、32 個 Xe3P 核心、256 組向量引擎與矩陣運算單元,搭載 LPDDR5X 記憶體(Intel 自有版 160GB,ODM 版最高 480GB),TDP 350W、氣冷 PCIe 設計;對比 Nvidia Vera Rubin 最高 288GB HBM4、AMD Instinct MI450X 最高 432GB HBM4。客戶送樣目標 2026 年下半年。

詳情分析 →
#06
應用案例 ·全球 ·Businessinsider

Thomson Reuters 用阿里 Qwen 打造自有模型,啟動對 Anthropic 的降依賴計畫

Thomson Reuters 週一推出首個自有 AI 模型 Thomson-1,底層基礎模型 Snowdon 由公司與英國帝國理工聯合團隊,花數月時間在阿里巴巴開源模型 Qwen 上重新對齊而成,首批應用場景為文件審查;CTO Joel Hron 表示,此舉不取代現有 Anthropic 合作,但長期目標是讓 Thomson 模型逐步接管旗下法律 AI 助理 CoCounsel 的更多功能。

詳情分析 →
電子報訂閱 ・ NEWSLETTER

看完今天的,讓明天的自己送上門

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

已出刊 95 期 ・ 隨時可退訂

近期焦點RECENT FOCUS
09-04輝達129億收購Hugging Face,買的是AI需求情報 09-03美國司法部撐OpenAI版權案,把訴訟說成地緣政治 09-02Anthropic 快取降價45%,OpenAI Astra首觸最高風險級別自行管控 09-01輝達35億押注聯發科,自研晶片時代的遊戲規則寫在NVLink裡 08-31中國記憶體874%暴增,算力租用繞道,管制框架追不上的那一天 08-30索尼華納控告Anthropic,版權攻勢有了新打法 08-29法官撤銷五角大廈黑名單,AI廠商拒絕軍事用途有了先例