日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

71
累積集數
597
則深度解讀
6
大追蹤分類

Anthropic 發布 Claude Sonnet 5:接近旗艦性能、定價大幅下調,主攻企業 AI 代理部署

2026-07-01 · 來源:Anthropic

Anthropic 正式推出 Claude Sonnet 5,定位是「有史以來最具代理能力的 Sonnet 模型」。簡單說,這一代的核心主張就是:幾個月前還需要旗艦級模型才能跑起來的 agentic 任務,現在用中階定價就能處理。

性能上,Sonnet 5 在推理、工具使用、程式碼和知識工作等評估維度大幅超越前代 Sonnet 4.6,且在部分任務的高強度執行上已能追上 Opus 4.8。這個跨越很關鍵——過去幾個月 agentic 能力的增益集中在 Opus 這條線,Sonnet 一直是「夠用但差一截」,現在這個差距顯著收窄。定價方面,導入期(至 2026 年 8 月 31 日)訂為每百萬 input token $2、output token $10;之後調為 $3 與 $15。Anthropic 特別說明,因為 Sonnet 5 換了新 tokenizer,同樣內容的 token 用量約為舊版的 1.0 到 1.35 倍,因此導入期定價設計上是要讓遷移成本大致持平。

從早期夥伴的回饋來看,實際效果相當一致:Lovable、Cursor、ClickHouse 等夥伴都反映 Sonnet 5 能完成以前 Sonnet 模型做到一半就卡住的多步驟任務——更新 Salesforce 帳戶分級、同步發送企業通知這種複合操作,現在可以端對端跑完。在 agentic 搜索評估 BrowseComp 和電腦操作評估 OSWorld-Verified 上,Sonnet 5 在不同努力等級下都嚴格優於 Sonnet 4.6,且成本效率在中等強度下提升明顯。

安全性方面,Sonnet 5 的幻覺率和諂媚行為均低於 Sonnet 4.6,對提示注入攻擊的抵抗力也更強。Anthropic 刻意未對 Sonnet 5 進行網絡安全任務訓練,它在 Firefox 漏洞利用等高危測試中從未成功開發出完整可用的 exploit,但部分成功率略高於 Sonnet 4.6——Anthropic 判斷這源於通用智能提升而非針對性訓練。因此 Sonnet 5 預設啟用網絡安全防護,但防護嚴格程度低於同期發布的 Fable 5。

這件事對部署決策意味著什麼?過去,企業在 AI 代理工作流上面臨一個經典困境:Sonnet 級別夠便宜但能力有缺口,Opus 級別夠強但成本難以規模化。Sonnet 5 試圖打掉這個二選一——讓那些「需要 Opus 能力、但 Opus 成本撐不住全線部署」的場景有了可行的替代路線。對正在評估大規模 agentic 工作流的企業決策者來說,遷移的成本門檻已經降低,但 tokenizer 變更帶來的用量膨脹因素仍需在實際工作流中自行驗算,不能直接拿舊版帳單做預算。Anthropic 把 Sonnet 5 設為免費版和 Pro 版的預設模型,也意味著這次不是單純的 API 產品更新,而是全線推進——能力下探、價格下拉,這是在替整個 agentic 應用市場重新定錨。

原文出處
原文標題 Introducing Claude Sonnet 5 - Anthropic
媒體來源 Anthropic
發布日期 2026-06-30
閱讀原文 ↗

訂閱品富智圖 AI 新聞

每日 AI 產業要聞彙整,一封信直送信箱。