日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

77
累積集數
633
則深度解讀
6
大追蹤分類

Anthropic 示警 Claude 逼近自我改進臨界點,呼籲多國頂尖實驗室協調暫停前沿開發

2026-06-07 · 來源:dallasexpress.com

Anthropic 於 2026 年 6 月 4 日發布詳細報告,由研究人員 Marina Favaro 與 Jack Clark 執筆,公開呼籲全球頂尖 AI 實驗室考慮協調性減速,甚至暫停最強大模型的開發。這份聲明的份量不在於呼籲本身,而在於 Anthropic 同時披露的內部實驗數據——這些數據具體刻劃出 Claude 正在以多快的速度逼近一條決定性的能力門檻。

在 Anthropic 引用的核心數據中,最具份量的是兩組對比實驗。2026 年 4 月,Claude 自動完成一項完整的 AI 安全研究專案:人類研究員僅負責選定題目與評分標準,其餘假設提出、實驗設計、測試執行、結果迭代全由 Claude 代理人自主完成。最終,人類研究員花一週僅能填補基準線與頂尖水準之間約 23% 的落差,Claude 代理人填補了 97%。同年 4 月預覽的前沿模型 Claude Mythos Preview 在程式碼最佳化任務上達到基準線的 52 倍加速,而一名熟練的人類研究員需要四至八小時才能達到 4 倍改善。目前 Claude 撰寫了 Anthropic 約 80% 的新生產程式碼,複雜開放式工程問題的成功率在 2026 年 5 月升至 76%。

更值得注意的是能力擴張的速度曲線:Claude 可穩定處理的任務時間跨度,大約每四個月翻倍一次,從 2024 年初的分鐘級任務,延伸至今日的 12 小時任務。Anthropic 預測 2027 年將達到以週為單位的自主任務。這意味著「遞迴式自我改進」的窗口——AI 系統自主設計並改善下一代版本——並非模糊的遠期風險,而是有可量測軌跡的近期事件。

Anthropic 明確承認,有意義的暫停需要「多個資源充足、處於或接近前沿的實驗室、在多個國家」在可驗證的條件下同意停止開發。這個條件本身就揭示了核心矛盾:中國的競爭者仍在快速推進,任何單邊暫停都意味著讓渡技術主導地位。Anthropic 一邊呼籲協調,一邊坦承自己並未停止內部開發。

對亞太地區的決策者而言,這份報告有幾個層次的意涵。第一,它確認了 AI 自主化的速度比大多數企業的應對規劃更快:若任務自主時間跨度真的持續每四個月翻倍,到 2027 年底,AI 代理人能自主完成的工作將覆蓋絕大多數知識工作情境,而不是少數特例。第二,Anthropic 呼籲國際協調的聲明,實際上是在向監管機構與政府施壓,要求建立可驗證的治理機制——這對正在制定 AI 法規的亞太國家是一個明確的政策信號。第三,這份報告重新界定了「AI 安全」的商業含義:不再只是模型對齊問題,而是整個產業鏈在人類監督能力追上之前,是否有能力煞車的問題。

Anthropic 自己的困境最能說明問題的本質:它是目前最積極示警 AI 風險的主要實驗室之一,同時也在以同樣的速度推進能力開發。這不是偽善,而是競爭邏輯的必然結果。真正的問題是,協調機制能否在自我改進窗口打開之前成形——而從目前的地緣政治格局來看,答案並不樂觀。

原文出處
原文標題 Anthropic Admitted Claude Is Close To Self-Improvement — Here’s What That Means - Dallas Express
媒體來源 dallasexpress.com
發布日期 2026-06-06
閱讀原文 ↗

訂閱品富智圖 AI 新聞

每日 AI 產業要聞彙整,一封信直送信箱。