abc小站

2026-09-01

Perplexity Portable Computer:本地跑代理,额度停在零

不是又一个本地聊天框。是把整套代理脚手架(模型、工具、连接器、沙箱)打成一个本地 App,默认先在你机器上干完活。

2026 年 8 月 25 日,Perplexity 和 Nvidia 一起发了 Portable Computer。对标的是自家云端的 Computer:读文件夹、分析数据、出报告、再把结果推进业务系统。本地版把同一套 UI 搬到本机。文件、模型和推理可以全程不出机器。本地完成的步骤不扣额度;只有某一环要升到更强云端模型时,才会先问你。

门槛不低,但省的是「拼栈」

启动机型:Nvidia DGX Spark,以及带 RTX 的 Linux 机器。显存底线大约 24GB,官方口径接近 GeForce RTX 3090 及以上。首发只给 Linux,Windows 说九月跟。订阅档是 Pro、Max、Enterprise Pro、Enterprise Max。

首发模型可选 Qwen 3.8 27B,或 Perplexity 自己后训练过的 PPLX 27B;Nemotron 3.5 Lightning 在路上。演示里,一台 Spark 上跑满 GPU 的 27B,翻完一叠 1099 和投资文件,把不该交的费用标出来。界面上平时显示云端额度的那一格,停在零。

另一段演示是本地吃完 funnel CSV,再靠连接器把结论推到 Slack。Google Drive、Gmail、GitHub 也能接。本地优先,不等于断网。

小模型和脚手架要一起设计

Perplexity 同期发了研究:本地代理不能照搬「给前沿大模型用的」大而全 harness。Qwen 3.8 27B 宣传上下文很长,他们实测过了约 10 万 token 就开始吃力。所以他们把系统提示压短,核心工具变少,能力做成按需加载的 skills;Gmail、GitHub 这类吃 token 的 MCP,收成紧凑命令行工具。沙箱开不起来,整套工具就停掉,不裸奔。

公司自己的 Local Knowledge Work Bench(53 项知识工作任务,说会开源)上:同一 Qwen,Computer 82.6%,开源 Pi harness 77.6%,Hermes 74.0%;PPLX 27B 到 85.4%。Terminal Bench 2.1 上,纯本地约 59.6%;允许升到 Claude Opus 当顾问约 73.0%、估约每任务 0.415 美元;纯前沿模型约 82.4%、约 0.65 美元。顾问升档前会过 PII 分类,并给你看将要离机的内容。

和 Ollama 比,他们自己划界:Ollama 解决推理起得来;Portable Computer 押注的是模型加 harness 整层。推理底层用 vLLM,也留了接自建推理端点的高级模式。

材料来自 VentureBeat 2026-08-25:Perplexity partners with Nvidia to launch Portable Computer。基准分数与价格为该公司自述/自测,文中已按原文口径写。本文不写订阅价目表。