OpenAI推出Ultrafast推理模式 攜手Cerebras加速GPT-5.6達14倍
幫你做功課
發生什麼事
OpenAI預告新API服務層Ultrafast,讓GPT-5.6 Sol模型推理速度提升最高14倍,採用Cerebras晶片技術,輸出速度達每秒750個token,目前為預覽階段。
為什麼重要
OpenAI開始在模型能力之外競爭推理速度,透過與專用晶片廠商Cerebras合作推出高速服務層,瞄準對延遲敏感的企業應用,可能加劇AI推理基礎設施的供應商分化與競爭。
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
OpenAI預告新API服務層Ultrafast,可讓GPT-5.6 Sol模型的運算速度提升至最高14倍,背後採用Cerebras的晶片技術,輸出速度達每秒750個token。此舉顯示OpenAI在既有的模型能力競賽之外,開始針對推理速度另闢戰場,透過與晶片廠商合作提供差異化的API服務層級,鎖定對延遲敏感的企業應用場景。目前僅為預覽階段,尚未提供完整技術細節或定價資訊。
電子報訂閱 ・ NEWSLETTER
看完今天的,讓明天的自己送上門
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
已出刊 104 期 ・ 隨時可退訂
原文出處
原文標題
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
媒體來源
OpenAI Blog
發布日期
2026-08-13
閱讀原文 ↗
