24GB 这条线才是这条新闻的实际内容
「本地 agent」听起来像个理念,加上这条硬件要求之后它变成一个采购问题:RTX 3090 或更好,显存不低于 24GB。按 Steam 的硬件统计,拥有达不到这条线的高端 N 卡的用户,大约是达标用户的两倍;商务笔记本和普通办公台式机离这条线更远。 所以它现在服务的是一个明确但不大的群体——手里已经有一块大显存卡的开发者、研究者和设计师。对企业采购,这条线意味着「给全员配本地 agent」在今天不是一个预算问题,是一个换机问题。 本站 9 月 2 日写过 Perplexity 在 Mac 上的混合计算,9 月 4 日写过它开源的本地推理引擎 Lily——那个引擎只服务一个模型、只跑 Apple 芯片。现在这条线扩到 Windows 加 RTX,形状是一致的:**用极窄的硬件与模型组合,换一份确定的本地性能。**代价始终是同一个:你得先有那块硬件。
值得照抄的一处产品设计:升级到云端要先问
对所有号称「本地优先」的产品,真正的风险从来不是本地那一段,而是它什么时候悄悄走了云端。Portable Computer 在这里的做法值得记下来:需要最新信息或更重推理时它可以升级到前沿云模型,但**会先征求同意,并且对要发出去的载荷做个人数据筛查**。代码和工具则在隔离环境里跑,对文件与已连接应用的访问是受控的。 把这一步做成显式确认而不是静默回退,是这类产品该有的默认值。顺带也提醒了额度那件事的边界:「不消耗 Perplexity Computer 额度」成立的前提是任务确实在本地完成;一旦升级到云端模型,这条就不再适用。
装之前先确认本地模型到底是哪个
有一处官方材料互相打架,值得在动手前留意:Perplexity 自己的产品页写的是 Windows 机器拿到的本地模型为 PPLX 27B,并明确说 Qwen 3.8 27B「在 Windows RTX PC 上不可用」;而英伟达的发布博客点名应用会安装 Qwen 3.8 27B。 两边说法不一致,目前没有第三方澄清。实际以应用内真正下载的那个模型为准——这也直接影响你能不能复现别人给出的效果数据。 除此之外的信息都比较干净:装在 Microsoft Store 的 Perplexity 应用里,包含在 Pro、Max、Enterprise Pro 与 Enterprise Max 订阅中,不单卖;DGX Station 的支持也一并宣布了。对已经在订阅内、且手上正好有 24GB 显存卡的人,这次更新的成本是零,值得试;其余的人可以先记下这条门槛,等下一轮硬件或模型把它降下来。