英伟达官宣:Perplexity 本地智能体 Portable Computer 登陆 Windows RTX PC

来源:爱集微 #NVIDIA# #24GB显存门槛# #端侧Agent# #产品发布#
371

英伟达 9 月 14 日在官方博客宣布,Perplexity 的本地智能体平台 Portable Computer 正式在 Perplexity Windows 应用中上线,面向配备 24GB 及以上显存 的 GeForce RTX PC 与 RTX PRO 工作站。智能体可在本机规划并执行多步骤任务,敏感数据与工作流留在设备端,本地完成的工作不消耗云端额度。此前,该智能体仅支持 DGX Spark 与运行 Linux 的 RTX PC,DGX Station 支持预计即将推出。

端侧运行的完整智能体栈

Portable Computer 是 Perplexity Computer 的本地版本,负责规划并执行多步骤任务。在 NVIDIA GPU 加速下,它借助本地模型分析数据、跨文件汇总信息并处理重复性工作,模型、智能体框架、编排器与调度器全部运行在设备端。英伟达在博客中强调,敏感信息留在本机,本地完成的工作不消耗 Perplexity Computer 云端额度。

当任务需要更强的推理能力或实时信息时,智能体会先行判断是否需要云端支持,并在征得用户明确授权后才将信息送出设备,进而调用 Perplexity Search 与 15 个以上的前沿模型。代码与工具在隔离沙箱环境中执行,应用同时内置浏览器与 Perplexity 专有的 SPACE 沙箱,安全机制与其云端版本保持一致。

一键下载的本地模型与生态连接

Windows 应用简化了部署流程:内置经 Perplexity Computer 专项后训练、针对 RTX GPU 优化的本地模型(如 Qwen 3.8 27B),用户在模型菜单中一键下载即可投入使用,无需自行调研模型选型,也不必配置运行本地 AI 所需的复杂软件栈。30B 级开源模型 NVIDIA Nemotron 3.5 Lightning 即将加入模型列表;听写模式由本地运行的 Nemotron 3.5 ASR 模型驱动,语音转写与文件操作同样留在本机。

生态连接方面,应用提供 Microsoft Outlook、OneDrive、Word、Google Drive、Gmail、Slack 与 GitHub 连接器,并可通过设备端运行的本地 MCP 服务器接入更多桌面应用。智能体可处理用户授权文件夹中的文档、表格、演示文稿、PDF、代码与图像;分析、文件处理等重复性工作流可设为定时任务,由本地模型在自有硬件上按计划执行。

三类典型场景

英伟达在博客中列举了三类示例工作流。工程场景下,智能体审查 GitHub 项目中待处理的 pull request,按状态归类,标记过时文档并提交更新建议供评审;财务场景下,用户将其指向两年期的券商对账单与报税材料,智能体在本地追踪制造不必要费用与税务损耗的重复持仓,每个数字都精确引用到文件与页码,全程没有一份文档会送达聊天机器人;创业场景下,智能体在本地分析转化漏斗导出数据,定位新用户从安装到完成首个任务之间的流失环节,再将关键结论推送至团队 Slack 频道。

从 DGX Spark 到 Windows 桌面

Portable Computer 于 8 月随 DGX Spark 首次亮相。DGX Spark 是围绕 Grace Blackwell GB10 平台打造的桌面级 AI 计算机,配备 20 核 Arm CPU 与 128GB 统一内存;该产品随后扩展至运行 Linux 的 RTX PC,并在发布时预告了 Windows 支持。据 Perplexity 官方说明,Windows 版已面向 Pro 与 Max 订阅用户(含个人版与企业版)开放,通过 Microsoft Store 中的 Perplexity Windows 应用下载使用。

本地推理的成本边界浮出水面

此番落地标志着智能体从云端托管向消费级硬件本地部署迈出关键一步。云端托管智能体长期面临两重顾虑:敏感数据出域,以及按量消耗的订阅额度。本地化方案以“数据不出设备、本地任务不扣额度”作出直接回应。与此同时,24GB 显存的硬件门槛也给出了本地化推理的现实成本边界:在当前阶段,端侧智能体仍属于高端 RTX 用户与专业工作站用户的选项。随着本地模型能力持续增强,端侧执行与云端强化的协同分工,正在成为智能体产品的新形态。

责编: 爱集微
来源:爱集微 #NVIDIA# #24GB显存门槛# #端侧Agent# #产品发布#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...