最新收錄
【對談】Rich Sutton:合成資料是下一個苦澀教訓,大型語言模型只是智慧的四分之一
強化學習這個詞你可能沒聽過,但 ChatGPT 背後讓它學會對話的那套機制,有一半的根基是 Rich Sutton 打的。他是強化學習領域的奠基人,在加拿大亞伯達大學深耕數十年,2019 年寫了一篇叫做 The Bitter Lesson 的短文——大意是:別把人類知識塞進 AI,讓演算法自己跟著算力成長才是正道——這篇文章現在是矽谷 AI 圈引用頻率最高的文獻之一。
閱讀全文 →