【演講】Boris Cherny鬆口:coding is solved 分母只有他自己
這種場合看多了,主持人捧,講者謙虛兩句,底下鼓掌,然後開始賣貨。但這次台上的人是Boris Cherny,寫出Claude Code的工程師——這是Anthropic(OpenAI最大對手之一,做Claude系列AI模型的公司)拿來讓自家AI模型寫程式的工具,矽谷工程師圈這兩年人手一個。訪談的由頭是Anthropic前一天剛發布新模型Opus 5,主持人劈頭就問跑分,Arc AGI 3測試從個位數跳到30%。這種數字每次發布都會被拿出來秀一輪,聽多了會麻木。但這場真正值得聽的不是跑分,是Boris講怎麼用這件事——這比模型本身更值錢。
整場訪談我抓出五個真正有意思的點:模型好像不太會被提示注入攻擊了,這是資安圈吵了三年的老問題;Claude Code的系統提示詞被砍掉八成,而且是每次新模型出來就重砍重寫;有個團隊真的讓AI花11天把一個十萬行的程式碼庫從一種語言重寫成另一種語言;有個內部實驗已經連續跑了兩週還沒停;最後Boris自己承認,寫程式這件事對他做的那種活已經算解決了。合起來看,這場訪談在講一件事:AI寫程式的門檻不是技術,是心態——你敢不敢把控制權交出去。
◎提示注入被解決,吹的牛先打個折
提示注入(prompt injection)是指AI在讀取外部資料時,被裡面藏的惡意指令牽著走,比如網頁上藏一句順便把用戶電腦清空,舊模型真的會照做。Boris說Opus 5配合三層防護,幾乎展示不出這種攻擊了。這話聽起來像業配,但他把方法攤開講了:對齊訓練加上專門偵測神經元反應的分類器,不是空口說白話。不過我要提醒一句,展示不出來跟不存在是兩回事,資安圈的規矩向來是不見得沒有,只是還沒被人找到。這種話聽七分就好。
◎系統提示詞砍八成,砍的是誰的自信
Claude Code的系統提示詞(相當於工具在背後偷偷交代AI該怎麼做的說明書)這次新版直接砍掉八成。原因很直白:過去寫在裡面的規矩,很多是在糾正舊模型的笨,新模型自己就懂了,那些叮嚀反而變成累贅。Boris講了個狠話:他們每次換模型,就把整包提示詞砍光,再一行一行加回來,叫做ablation(拿掉東西看有沒有差)。這對一般公司來講是恐怖故事——半年砍一次系統重寫,傳統軟體公司想都不敢想。但他反過來建議所有做AI產品的人,每六個月就該把自己寫的提示詞,規則全部砍掉試試看,模型可能根本不需要那些嘮叨。這句話與其說是技術建議,更像是在說一句扎心的話:你以為自己在教AI,其實你只是在替一個一直進步的東西背歷史包袱。
◎十一天重寫十萬行,分母是什麼很重要
最戲劇性的例子:Anthropic自己用的JavaScript執行環境Bun,底層原本用Zig語言寫,團隊讓AI把它整個重寫成Rust語言,跑了11天,寫的東西超過十萬行,現在已經上線在用。Boris自己說,這種工程如果找最好的工程師來做,至少要一年以上。這數字聽起來嚇人,但要注意分母:Bun本身測試覆蓋率極高,能拿現成的大量測試來驗證AI寫得對不對——換句話說,這是有解答本可以對答案的重寫,不是憑空發明。這件事真正的意義不在11天這個數字本身,而在於驗證機制本身變成了新的護城河。由此我斗膽下一個判斷:未來一年內,會有至少一家非AI公司(不是Anthropic,OpenAI這類做模型的公司)公開宣布,用類似方法把一個上線超過五年的核心系統做過完整跨語言重寫,而且是在有完整測試覆蓋的前提下才敢做——沒有測試覆蓋的老系統,這條路現在還走不通,2027年7月前可以拿新聞跟財報對帳。
◎兩週還沒停的任務,才是這場最誠實的段落
訪談裡最好玩的不是那些精修過的案例,是Boris自己承認,他兩週前丟給AI一個任務——把公司的桌面應用程式從Electron重寫成蘋果的Swift語言,一路跑到現在還沒結束,他自己也不知道總共啟動了幾個子任務,只能用猜的,猜是幾千到幾萬個。這段話比任何跑分都誠實:連創造這個工具的人,都已經跟不上自己工具的進度。這不是吹噓,這是有點狼狽的老實話,我反而信。
◎寫程式已解決這句話,分母只有他自己
Boris說coding is solved(寫程式這件事已經解決),但他自己立刻補了但書:這句話只對他做的那種程式成立,深度系統程式,分散式系統,像素級的UI校正,AI現在還是常常翻車。現場問誰百分之百用AI寫程式,舉手的沒幾個,問超過一半的,也差不多。這才是這場訪談該被記住的部分——不是模型多神,是連做這行的人都誠實承認邊界在哪裡。裝腔作勢的公司會把解決兩個字印在標題上不加但書,Boris好歹把分母講清楚了,這點值得記一筆。
這場訪談沒有太多新奇的詞彙轟炸,反而像一堂樸素的工程課:砍掉重練不可怕,可怕的是捨不得砍。模型的能力邊界每半年就往外挪一格,而多數公司的組織習慣,決策流程還停在半年前那格。Boris講的道理老早就有人講過——工具再強,決定輸贏的永遠是敢不敢承認舊做法已經過時的那個人。這場真正值得記住的,不是Opus 5多會畫畫多會跑分,是一個做工具的人,願意當眾說我也不知道它跑了幾個任務。
介紹Opus 5的新能力,包括可以連續執行數天到數月不停止,以及不需要額外指令即可持續任務
說明模型對提示注入的抵抗力大幅提升,並解釋三層防護機制(對齊訓練,分類器,機制可解釋性研究)
說明Claude Code每次新模型發布都會刪除大量系統提示詞,並介紹ablation(消融測試)的做法
講述Bun團隊讓Claude將Bun的核心程式碼從Zig重寫為Rust,耗時11天並已上線使用的案例
分享內部意外發現Opus 5可用OpenCV繪圖的案例,說明模型有未被開發的隱藏能力
描述自己讓Claude將桌面應用程式從Electron重寫為Swift的實驗,任務已連續執行超過兩週仍在進行
解釋dynamic workflows與loops/routines兩種讓Claude自動維護程式碼庫的機制,包含清理死碼,撰寫測試等每日自動任務
澄清coding is solved僅適用於他自身工作範疇,現場詢問聽眾使用AI寫程式比例作為對照
訂閱品富智圖 AI 新聞
每日 AI 產業要聞彙整,一封信直送信箱。
