日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

130
累積集數
950
則深度解讀
6
大追蹤分類

Anthropic 推出 Claude Haiku 5.5:短請求 API 費用降九成,與 GPT-6 Luna 正面競價

2026-10-08 · 來源:VentureBeat
幫你做功課
發生什麼事

Anthropic 發布 Claude Haiku 5.5,100,000 token 以下請求的輸入費率降至每百萬 0.10 美元、輸出 0.50 美元,較前代 Haiku 4.5 降九成,估計整體工作負載平均省 75%;超過該門檻費率跳升五倍。同步調降 Sonnet 5.5 快取讀取費率,並為 Max 與 Team 訂閱用戶新增月度 API 額度。

為什麼重要

這波降價讓 Haiku 在小請求區間直接與 GPT-6 Luna 齊平,企業在設計代理架構時用便宜小模型跑重複性任務的成本門檻又低了一截;但真正的競爭不在標價,而在完成同一任務的實際 token 消耗與正確率——這才是值不值得大量部署的關鍵。

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

Anthropic 發布 Claude Haiku 5.5,針對企業大規模重複性任務直接拿價格開刀——100,000 token 以下的請求,輸入費用降至每百萬 0.10 美元、輸出 0.50 美元,較前代 Haiku 4.5 大砍九成;換算整體工作負載,Anthropic 估計平均省下 75%(計入新版 tokenizer 消耗略增的抵消效果後)。這個定價正面對齊 OpenAI 的 GPT-6 Luna。

費率結構有一條重要分界線:請求超過 100,000 token,費用直接跳到每百萬 0.50 美元輸入、2.50 美元輸出,是低階費率的五倍。Anthropic 自己的資料顯示,九成的 Haiku 4.5 請求都落在較短的區間,意思是大多數用量確實能吃到最低費率。相較之下,GPT-6 Luna 的分界門檻設在 272,000 token,彈性更大。從市場競爭角度看,Google Gemini 3.5 Flash-Lite 的標準輸入費率是 0.30 美元,Grok 4.3 是 1.25 美元,Haiku 5.5 在小請求這個區間確實站穩最低價格檔,但這比的是標價,不是完成同一個任務的實際總費用。

Anthropic 推出 Claude Haiku 5.5:短請求 API 費用降九成,與 GPT-6 Luna 正面競價

Haiku 在 Anthropic 產品線裡的定位很清楚:替 Opus 和 Sonnet 這些主力跑腿。用 Rogo(金融 AI 公司)的例子來說,更大的模型組裝一份財務簡報,Haiku 負責去抓某一頁需要的營收數字。這種分工邏輯的核心是:夠準、夠快、夠便宜,可以跑很多次。Rogo 的應用 AI 工程師 Alex Wang 在 Anthropic 提供的聲明裡這樣形容它。

benchmark 表現值得注意,但要看清楚條件。Anthropic 提供的資料顯示,Haiku 5.5 在知識工作(GDPval-AA v2.1:1,620 分,Haiku 4.5 為 735 分)、電腦操作(OSWorld 2.1:72.4%,前代僅 15.7%)和代理編碼(Terminal-Bench 4.0:39.2%,前代為 0%)均大幅超越前代、也超過 GPT-6 Luna。但有兩點要留意:這些是廠商自己提供的數字,未經獨立驗證;Terminal-Bench 的 39.2% 是最高 effort 設定下的結果,預設的 medium effort 只有約 20%。Haiku 5.5 新增了可調整 effort 層級的功能,比較數字前要先確認用的是哪個設定。

速度方面,Anthropic 稱 Haiku 5.5 是標準模式下最快的模型,但沒有公布具體的 tokens-per-second 數據。客戶引言提供了一些方向:Box 回報延遲降低約一半,Asana 回報每個代理回合的推論速度加快最多 2.5 倍,HubSpot 的 CRM 評估拿到 92.8% 的平均分。這些都是企業自己提供的引言,不構成跨供應商的客觀比較基準。

此次公告不只是 Haiku 一個模型降價。Sonnet 5.5 的快取讀取費率從每百萬 0.20 美元降至 0.10 美元,Anthropic 估算代理工作負載約節省 20%;Max 與 Team 訂閱方案同步推出月度 API 額度(Max 5x 方案每月 100 美元、Max 20x 每月 200 美元、Team 方案最高 500 美元共享),可用於 Anthropic 平台上的任何模型。

對企業開發者來說,這波降價讓「先用 Haiku 試試」的機會成本大幅下降。問題從來不是價格夠不夠低,而是在窄範圍任務裡,Haiku 5.5 的準確率夠不夠穩定,能讓它跑幾千次都不掉球。Anthropic 自己的 benchmark 也明說:複雜任務還是留給更大的模型。

電子報訂閱 ・ NEWSLETTER

看完今天的,讓明天的自己送上門

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

已出刊 130 期 ・ 隨時可退訂

原文出處
原文標題 Anthropic launches Claude Haiku 5.5 with 90% API price reduction, matching GPT-6 Luna | VentureBeat
媒體來源 VentureBeat
發布日期 2026-10-07
閱讀原文 ↗