日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

95
累積集數
738
則深度解讀
6
大追蹤分類

Perplexity 攜手輝達推出 Portable Computer,全本機 AI 代理讓 token 帳單歸零

2026-08-26 · 來源:VentureBeat AI
幫你做功課
發生什麼事

Perplexity 與輝達聯合發布 Portable Computer,將代理 AI 平台移至本機執行,支援輝達 DGX Spark 與 RTX GPU(至少 24GB VRAM)的 Linux 機器,9 月加入 Windows;可用模型含 Qwen 3.8 27B 及自家後訓練的 PPLX 27B,連接 Google Drive、Gmail、GitHub;本機執行不消耗 token 也不計費,需送雲端的步驟須使用者逐步確認。

為什麼重要

AI 代理不是聊天——一旦長時間、多步驟運作,token 帳單和隱私洩露都失控;Portable Computer 把推理成本壓到零,同時為輝達 DGX Spark 找到了「真正被用上」的理由,也替 Perplexity 打開法律、醫療、金融等對雲端傳輸最敏感的企業市場。

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

雲端計費的邏輯,正在被一個站在桌上的小盒子重新挑戰。

Perplexity 與輝達在週一聯合發布 Portable Computer——把原有的雲端代理平台 Computer,完整搬到使用者自己的機器上執行。起步支援輝達 DGX Spark 桌上型超級電腦與搭載 RTX GPU 的 Linux 機器,9 月再追加 Windows 支援。硬體門檻是至少 24GB VRAM,大約從 GeForce RTX 3090 起跳。可使用的模型包括阿里巴巴 Qwen 3.8 27B、Perplexity 自行後訓練的 PPLX 27B,以及即將推出的輝達 Nemotron 3.5 Lightning,並連接 Google Drive、Gmail、GitHub 等服務。

這套系統的核心主張只有一個:所有推理預設在本機跑,不動用雲端的步驟,token 消耗量為零。Perplexity 工程副總裁 Nate 在發布會上特別展示那個「信用計數器停在零」的畫面——代理程式翻遍一整個資料夾的報稅文件,帳單一毛沒動。這正是代理 AI 時代與過去聊天 AI 時代的關鍵差異:聊天是一問一答,代理是長時間、多步驟、高度重複的運算,持續送上雲端計費,成本和隱私都難以控管。

技術層面最值得注意的,是 Perplexity 選擇自己動手設計代理 harness,而不套用 Ollama 等通用框架。他們發現像 Qwen 3.8 27B 這種宣稱支援 26 萬 token 上下文的模型,實際上超過 10 萬 token 就開始表現失穩,於是刻意縮短 system prompt、把工具設計為按需載入的「技能」,並把 Gmail、GitHub 等連接器從肥大的 MCP server 改寫成精簡的命令列工具。沙箱防護方面,一旦 OS 層沙箱不可用,整個 harness 直接停擺,而不是在沒有保護的情況下繼續跑工具——這和大多數開源框架預設用完整使用者權限執行指令的做法形成對比。

成績數字來自 Perplexity 自家的 Local Knowledge Work Bench(53 個涵蓋深度研究、財務分析、文件撰寫的任務,公司表示即將開源):Qwen 3.8 27B 搭配 Perplexity 的 harness 在 DGX Spark 上跑出 82.6%,高於開源競品 Pi 的 77.6% 和 Hermes 的 74.0%;自家後訓練的 PPLX 27B 進一步推至 85.4%。在 BrowseComp 網路研究基準上,差距更大:Perplexity 66.7% 對 Pi 50.2%、Hermes 43.9%,且用時少 51%、token 少 70%。這些數字全由 Perplexity 自行評測,須保留一定折扣。

最有商業意義的一組數字是混合模式的實驗:在 Terminal Bench 2.1 編碼基準上,純本機 Qwen 跑出 59.6%,幾乎零成本;允許它在遇到瓶頸時請教雲端的 Claude Opus 5,分數升至 73.0%,每次任務估算成本約 0.415 美元;全程只用 Claude Opus 5 則是 82.4%,每次 0.65 美元。換句話說,混合模式用雲端旗艦模型三分之二的成本,補回了本機與旗艦差距的六成——而且在送出任何資料之前,harness 會先跑一個 PII 分類器讓使用者確認。

對兩家公司來說,這場合作各有盤算。Perplexity 正面臨紐約時報等出版商的著作權訴訟,需要一個不靠逐 token 計費就能說服法律、醫療、金融等隱私敏感企業的切入點。輝達的 DGX Spark 一直賣得動、卻「難以真正上手」——與會者直接用「這個體驗很糟糕」來形容,Portable Computer 的一鍵安裝邏輯,就是那台機器真正被用起來的關鍵。Nader 被問到 Spark 是否會預裝 Portable Computer 出貨時,沒有否認,只說「那會很酷」。

現在的限制很明確:Linux 優先、24GB VRAM 門檻把市面上絕大多數消費級電腦擋在門外,Apple Silicon 根本不在路線圖上。本機模型在複雜推理任務上仍落後雲端旗艦。但方向已經明確:AI 代理的運算重心,正從幾千個租來的 GPU 機架,向個別使用者桌上那台機器慢慢移動。

電子報訂閱 ・ NEWSLETTER

看完今天的,讓明天的自己送上門

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

已出刊 95 期 ・ 隨時可退訂

原文出處
原文標題 Perplexity partners with Nvidia to launch Portable Computer, a fully local AI agent with zero token costs
媒體來源 VentureBeat AI
發布日期 2026-08-25
閱讀原文 ↗