Perplexity的便携式计算机登陆Windows RTX GPU平台
TECH

Perplexity的便携式计算机登陆Windows RTX GPU平台

28+
Signals

战略概览

  • 01.
    2026年9月14日,Perplexity将其Computer智能体的本地版本——便携式计算机(Portable Computer),通过Perplexity Windows应用推向市场,可在NVIDIA GeForce RTX PC和RTX PRO工作站上运行。
  • 02.
    本地推理需要配备至少24GB显存的NVIDIA GeForce RTX或RTX PRO GPU,这一门槛排除了当前大多数消费级显卡。
  • 03.
    Windows版便携式计算机可通过微软应用商店安装,但仅限于个人和企业计划中的Perplexity Pro和Max订阅用户使用。
  • 04.
    该工具在设备上运行经过后训练的PPLX 27B模型和Qwen 3.8 27B模型,NVIDIA的Nemotron 3.5 Lightning模型也即将加入。

24GB显存门槛:为何便携式计算机的硬件限制揭示了其完整的智能体架构,而非一个聊天机器人

Perplexity在Windows平台发布的便携式计算机要求配备至少24GB显存的NVIDIA GeForce RTX或RTX PRO GPU[1]。这一门槛对于表面上看似桌面AI助手的产品而言异常之高,并带来了实际影响:它排除了当前RTX 50系列消费级显卡的大多数型号,包括RTX 5080(16GB)、RTX 5070 Ti和RTX 5070(12GB)[2]。只有高显存显卡符合要求——RTX 3090和3090 Ti(24GB)、RTX 4090(24GB)、RTX 5090(32GB),以及工作站级的RTX PRO 4500 Blackwell(32GB)和RTX PRO 6000 Blackwell(96GB ECC)[3]。硬件行业媒体认为,这一高门槛是刻意设计的信号,而非缺陷:‘协调器、规划器、工具路由、调度器、持久任务队列和本地搜索索引全部在设备上运行。这并非一个底部挂载小模型的聊天窗口’[2]。换句话说,便携式计算机试图在本地复现Perplexity完整的云端智能体架构,而同时运行一个协调器和一个270亿参数模型正是消耗大量显存的原因。这些与2026年8月仅限Linux的DGX Spark版本一同发布的PPLX 27B和Qwen 3.8 27B模型,已延续至Windows版本[4],而NVIDIA更新的Nemotron 3.5 Lightning模型也即将加入。

Perplexity用以证明本地化合理性的基准测试——以及其仍存在的短板

Perplexity自身的基准测试声称其本地模型可匹敌甚至超越较轻量的智能体架构。在53项任务的本地知识工作基准(Local Knowledge Work Bench)中,运行Qwen 3.8 27B的Computer智能体得分为82.6%,后训练的PPLX 27B得分为85.4%,优于开源的Pi架构(77.6%)和Hermes(74.0%)[5]。在BrowseComp网页研究基准测试中,Computer的准确率达到66.7%,同时耗时减少51%,使用的token数量减少70%,优于Pi架构[5]。但在复杂推理方面表现则不那么理想:在Terminal Bench 2.1这一编码基准测试中,仅使用本地Qwen模型的得分为59.6%,边际成本接近于零;升级至Claude Opus 5后提升至73.0%,每项任务成本为0.415美元;而前沿云端模型单独运行仍以82.4%的得分领先,每项任务成本为0.65美元[5]。Qwen 3.8 27B还宣称支持26万个token的上下文窗口,但报告指出其有效性能在超过约10万个token后会下降[4][5]。Perplexity并未回避这一权衡,反而加以强调。工程副总裁Nate表示,Windows版本将公司的完整技术栈下放至设备端:‘我们基本上将完全相同的UI带到了一个完全本地化的应用中,整合了整个智能体架构和推理能力’[5]。NVIDIA开发者技术总监Nader则认为,对智能体而言,经济性比原始分数更重要:‘对于智能体……你不是按token计费的。你不需要为token付费。因此这对智能体来说是杀手级优势’[5]。VentureBeat的独立分析则更为审慎,指出此次发布‘目前非常聚焦于NVIDIA硬件’,路线图中尚无Apple Silicon支持,且此前仅为Linux独占,此次才扩展至Windows[5]

为‘免费’本地AI付费:Perplexity尚未解决的商业模式矛盾

尽管便携式计算机完全在用户自有GPU上运行,Windows版并非免费:它仅对Perplexity Pro(每月20美元)和Max(每月200美元)的个人及企业订阅用户开放[3][6]。敏感文件可在本地处理,无需离开设备,且本地任务不消耗云端额度——用户仅在明确批准升级至更强模型或使用实时网络数据时才消耗云端token[3]。这一卖点(私密、无云成本执行)与访问本身仍需持续付费订阅的事实形成尴尬对比,尽管计算是在用户已拥有的硬件上进行。这种矛盾并非新问题:2026年8月,Perplexity首次在NVIDIA的DGX Spark硬件上为Linux推出便携式计算机,早于此次Windows发布,Reddit社区对该DGX Spark独占版本的反应褒贬不一。早期测试者认为本地推理速度尚可,但不少人对一个以本地优先为卖点却需订阅的产品表示公开怀疑,且当时功能被描述为狭窄——主要是本地聊天,缺乏如今Windows版所宣传的完整连接器和技能生态。Windows用户是否会提出相同抱怨尚待观察,但核心问题——为在自己已购买的硬件上运行模型而支付订阅费——在此次更广泛的RTX推广中依然存在。

NVIDIA的更大布局:将便携式计算机转化为硬件和OEM销售渠道

对NVIDIA而言,便携式计算机既是AI产品,也是硬件销售话术。此次Windows发布是联合品牌推广,由NVIDIA在其官方博客以‘Perplexity便携式计算机现已登陆Windows,由NVIDIA RTX驱动’为题联合宣布[7],并直接集成到包括Microsoft Outlook、OneDrive和Word,以及Google Drive、Gmail、Slack和GitHub等办公工具中[3]。NVIDIA还表示,对其DGX Station工作站的支持即将推出[3],将其本地智能体理念进一步延伸至其产品线高端。在模型方面,NVIDIA自研的Nemotron 3.5 Lightning——一款300亿参数的混合专家模型,每token约激活30亿参数,专为智能体工具调用设计,于2026年8月11日发布——也即将加入便携式计算机,使NVIDIA能将其研究成果直接导入面向消费者的产品中[8]。发布后的公众反应强化了OEM导向:Perplexity与NVIDIA的官方社交账号均将此次发布定位为Windows/RTX的联合推广,几天后Perplexity还单独宣布其基于云的Computer智能体将预装于一款HP工作站笔记本,并集成新的Autodesk工具——这表明该公司正推进硬件合作伙伴协议,尽管该特定设备组合不在本文讨论的核心VRAM限制型便携式计算机新闻范围内。

历史背景

Perplexity Computer,即便携式计算机的云端前身智能体,首次发布。
NVIDIA发布Nemotron 3.5 Lightning,一款300亿参数的混合专家模型,每token约激活30亿参数,专为智能体工具调用设计,后续计划用于便携式计算机。
便携式计算机最初为Linux发布,由Perplexity与NVIDIA合作,专为DGX Spark桌面AI计算机打造,支持Qwen 3.8 27B和PPLX 27B。
便携式计算机通过微软应用商店扩展至Windows平台,新增对至少配备24GB显存的NVIDIA GeForce RTX和RTX PRO GPU的支持。

关键关系图

关键玩家
主题

Perplexity的便携式计算机登陆Windows RTX GPU平台

事实来源

8 条引用
  1. [1] Perplexity's local AI agent comes to Windows, but only for RTX GPUs with at least 24GB of VRAM
  2. [2] Perplexity Portable Computer reaches Windows and its 24GB VRAM floor shuts out most of the RTX 50 stack
  3. [3] NVIDIA partners with Perplexity to bring Portable Computer AI to Windows PCs on high-end RTX GPUs
  4. [4] Perplexity AI launches Portable Computer, an on-device AI agent
  5. [5] Perplexity partners with NVIDIA to launch Portable Computer, a fully local AI agent with zero token costs
  6. [6] Perplexity Portable Computer NVIDIA RTX
  7. [7] Perplexity Portable Computer Is Now Available on Windows, Powered by NVIDIA RTX
  8. [8] Perplexity Portable Computer local AI agent

来源文章

Top 5

THE SIGNAL.

Analysts

将便携式计算机描述为将公司完整的智能体架构和推理栈移植到本地应用,而不仅仅是复制界面。

Nate
Perplexity工程副总裁

认为避免按token计费对于多步骤的智能体工作负载比单次聊天查询更为重要。

Nader
NVIDIA开发者技术总监

将24GB显存要求解读为产品在本地运行完整智能体架构的证据,同时指出其排除了当前大多数RTX 50系列显卡。

hwbusters.com
硬件行业媒体分析

指出紧凑型本地模型在复杂推理上仍落后于前沿云端模型,Apple Silicon未在路线图中,且该努力仍局限于NVIDIA硬件。

VentureBeat
科技行业报道/分析
The Crowd

Portable Computer is now available on Windows PCs with @NVIDIA RTX GPUs. Run the harness, agents, and models locally on your PC. Work with local files and connected apps without sending tasks to the cloud. Use frontier cloud models when needed.

@@perplexity_ai1043

Powerful AI agents are becoming easier to run right on your PC. ⚡ Together with @Perplexity_AI, we’re making local AI more private, accessible and useful on @Windows NVIDIA RTX PCs.

@@nvidia860

Perplexity Computer will now come pre-installed on HP ZBook Ultra G3a. . Use Computer to run complex multi-step work from a simple interface. Computer agents are grounded in accurate deep research and connected to hundreds of tools, now including Autodesk.

@@perplexity_ai255

Feedback on Perplexity Portable Computer with local inference

@u/nickinnov24
Broadcast
Portable Computer demo | Short Sessions

Portable Computer demo | Short Sessions

DGX Spark Live: Perplexity Portable Computer Goes Local

DGX Spark Live: Perplexity Portable Computer Goes Local

NEW Perplexity Portable Computer is SCARY GOOD!

NEW Perplexity Portable Computer is SCARY GOOD!