【專訪】李飛飛押注世界模型,但她說還在 2019
人形機器人還不會幫你裝洗碗機,但投資人已經砸了六十億美元進去。世界模型這個詞突然滿天飛,每家大公司都說自己在做,沒有人說清楚做到哪裡了。就在這個時間點,李飛飛(Fei-Fei Li)接受了 Bloomberg 的專訪。她是史丹佛教授,Google 前高管,替美國總統與聯合國提供 AI 政策建議的科學家——更重要的是,她在 2006 年建了 ImageNet,一個收錄一千四百萬張照片的視覺資料庫,直接觸發了現代 AI 的起點。她不是在場邊評論的人,她是點火的那個人。現在她創了業,公司叫 World Labs,押注的方向不是 ChatGPT 那條路,而是她認為更根本的下一關:讓機器理解真實世界的空間與物理規律。
這場訪談有幾個值得說的點。第一,世界模型到底是什麼,跟大型語言模型的分工在哪裡——李飛飛給出了她自己的分類框架,比市面上大多數說法清楚。第二,World Labs 的第一個產品 Marble 已經在跑,但整個領域還很早,她自己說大概等同於 2019 年的聊天機器人——還沒爆發。第三,她對 AI 監管的立場:從科學出發,別被科幻帶著走,這話是對著華盛頓說的。第四,她對幾位 AI 大公司 CEO 被批評有「上帝情結」的回應,說得很節制,但態度很清楚。合起來看,這是一個業界元老在新創第一線的自白——既有科學家的長線視角,也有創業者的日常焦慮,兩種身分同時上線。
◎世界模型不是反 LLM,是下一章
李飛飛把世界模型分成三類:渲染,模擬,規劃。渲染是給人看的,輸出漂亮畫面,OpenAI 的 Sora 是這一類。模擬是給機器用的,抓的是世界的幾何與物理結構。規劃則是告訴機器下一步要做什麼,例如機器人看到一個杯子,世界模型告訴它把杯子拿起來放到另一個地方。她說得很直:語言不夠用。你可以用文字描述怎麼接球,但接球這件事語言做不到。這個框架聽起來合理,但她也坦承,整個領域現在大概還在 2019 年聊天機器人的位置——方向對了,爆發點還沒到。
◎Marble 是第一步,但離能用還有距離
World Labs 目前推出的產品叫 Marble,讓使用者用一張圖或一段文字描述,生成可以在裡面移動的 3D 世界。電影虛擬製作,遊戲開發,機器人訓練都是她列的應用場景,其中和 NVIDIA 合作用 Marble 環境訓練機器人是比較具體的案例。公司目前五十人,已募資十億美元。但她說得很清楚:現在還在建技術的階段,業務還早。資金夠不夠用到下一個里程碑,她說不知道,「要做得好才能賺到」。這種說法誠實,但也意味著商業模式還沒站穩。
◎小公司對大公司,她的答案是專注
Google,Meta,微軟這些巨頭都在做世界模型相關的研究,資源比 World Labs 深得多。李飛飛說她每天都在焦慮,但沒有被壓垮。她的邏輯是:大公司桌上的事情太多,World Labs 只有一件事。訪談裡一位共同創辦人補了一句話,說在五十人的公司,你的手真的可以改變公司走向,大公司做不到這件事。這個論點不新,每家早期新創都這樣說,但在世界模型這個領域還沒有定論的當下,專注確實是小公司少數幾個真實優勢之一。
◎監管要從科學出發,不是從科幻出發
李飛飛替美國總統與聯合國提供 AI 政策建議,她說進去的原則是:不炒作,不走極端,把科學事實講清楚,政策制定者說錯了就推回去。她明確批評了一種話語方式——用 AGI 機器霸主,人類滅絕這類末日敘事主導政策討論,她認為這會分散真正重要的政策工作。她的建議是把資源投入公共部門和 STEM 教育,因為人力資本才是最重要的資源。這個立場和幾位矽谷 AI 公司 CEO 的公開言論有明顯距離,她沒有點名,但意思很清楚。
◎上帝情結這個詞,她接了
訪談裡被問到幾位 AI 大公司 CEO 被外界批評有上帝情結,認為自己比所有人都懂什麼對人類最好。李飛飛的回答是:任何個人以為自己比所有人都懂,這很危險。她說創業的前提是來貢獻社會,賦能人,不是替所有人做決定。她沒有具體指名誰,但這個問題放在那裡,答案就是答案。她接著說,這也是為什麼公民社會不能放棄 AI 治理——集體治理比個別強人決策更重要。這段說得節制,但立場一點都不模糊。
世界模型這個賭注值不值得下,現在沒有人知道。李飛飛自己說還早,比聊天機器人早很多。但她也是那個在沒有人關注資料的年代建了 ImageNet 的人,後來那個資料庫成了現代 AI 的地基。押注她再看錯一次,需要更多理由。
主持人介紹李飛飛的背景:ImageNet,電腦視覺,Godmother of AI 稱號,以及她創辦 World Labs 的脈絡,是理解整場訪談的前提。
李飛飛把世界模型分成渲染,模擬,規劃三類,並說明各自服務對象與功能差異,是全場最具體的技術說明。
示範 World Labs 第一個產品 Marble,展示從單張圖片生成可導覽 3D 世界的能力,並說明電影,遊戲,機器人訓練三個應用場景,包含與 NVIDIA 的合作案例。
李飛飛同意主持人的比喻:世界模型現在大概等同於 2019 年的聊天機器人,方向對但還沒爆發,整個領域連怎麼建都還沒共識。
說明她替美國總統與聯合國提供建議的原則:從科學事實出發,不走末日或烏托邦兩個極端,並批評用 AGI 機器霸主敘事主導政策討論會分散真正重要的工作。
列舉世界模型潛在風險:錯誤資訊,機器人被武器化,學生過度依賴。接著回應 AI 公司 CEO 被批評的上帝情結問題,表明任何個人認為自己比所有人都懂是危險的立場。
說明在五十人公司裡個人可以真正改變公司走向,這是大型 AI 公司無法提供的,呼應 World Labs 以專注對抗大公司資源的策略。
訂閱品富智圖 AI 新聞
每日 AI 產業要聞彙整,一封信直送信箱。
