@stretchcloud: 本地推理正成为一个产品类别,而不仅仅是一个基准测试表。Perplexity 在 Wi… 上推出了 Portable Computer。

X AI KOLs Timeline 新闻

摘要

Perplexity 在 Windows RTX 电脑上推出了 Portable Computer,使得本地 AI 推理能够通过设备上的代理工具实现,将竞争格局中的焦点从推理成本转向工具质量。

本地推理正成为一个产品类别,而不仅仅是一个基准测试表。 今天,Perplexity 在 Windows RTX 电脑上推出了 Portable Computer。协调器 LLM、子代理 LLM 和完整的代理工具都在设备上运行。对于大多数任务,没有云依赖。本地运行时零 token 成本。 硬件要求:至少 24GB VRAM 的 NVIDIA RTX GPU。RTX 3090 及更新型号。默认本地模型是 Qwen 3.8 27B,专门为 Perplexity Computer 的工具进行了后训练。前沿云模型在推理需要时按需调用。 这不是另一个本地运行的聊天包装器。它是一个完整的代理堆栈,具有任务规划、子代理委托、文件访问和连接应用,运行在您拥有的硬件上。 竞争格局:Ollama 进行本地模型服务。LM Studio 和 http://Jan.ai 添加桌面 UI。AnythingLLM 添加 RAG。它们都没有提供生产级的代理工具,将协调器和子代理层作为一等原语。 NVIDIA 在市场上拥有超过 1 亿个 RTX GPU。目前拥有 24GB 或更多显存的份额只是一小部分,但每一代新的 RTX 都将 24GB 推向主流价格点。 我的看法:瓶颈从推理成本转向工具质量。Perplexity 将自己定位为工具,而不是模型。这是一个真正的战略赌注。
查看原文
查看缓存全文

缓存时间: 2026/09/15 13:52

本地推理正在成为一类独立的产品,而不仅仅是跑分榜上的一个条目。

今天,Perplexity 在搭载 NVIDIA RTX 显卡的 Windows PC 上推出了 Portable Computer(便携式计算机)。其编排器大语言模型、子代理大语言模型和完整的代理运行环境均在本地设备上运行。大多数任务无需依赖云端,在本地运行时不产生任何 token 成本。

硬件要求:配备至少 24GB 显存的 NVIDIA RTX GPU,具体型号为 RTX 3090 及更新系列。默认的本地模型是 Qwen 3.8 27B,该模型专为 Perplexity Computer 的运行环境进行了后训练。当推理任务需要时,可按需调用前沿云端模型。

这并非又一个在本地运行的聊天套壳应用。它是一个完整的代理技术栈,包含任务规划、子代理委派、文件访问以及可连接的应用程序,全部运行在您自己拥有的硬件上。

竞争格局方面:Ollama 提供本地模型服务,LM Studio 和 http://Jan.ai 增加了桌面图形界面,AnythingLLM 添加了检索增强生成功能。但它们中没有任何一家将生产级的代理运行环境(包含编排器和子代理层级作为一等公民)作为核心产品推出。

NVIDIA 在市场上拥有超过 1 亿张 RTX 显卡。目前其中显存达到或超过 24GB 的比例尚小,但每一代新的 RTX 产品线都在将 24GB 显存推向主流价格区间。

我的看法是:瓶颈正从推理成本转向运行环境的质量。Perplexity 将自身定位为运行环境,而非模型本身。这是一个真正的战略性押注。


Jan - 开源的 ChatGPT 替代方案

来源:https://www.jan.ai/ Logo Jan

认识 Jan

只为你效劳的个人智能助手

Jan 应用程序界面

Jan 应用程序界面

开放的模型生态系统

Jan Agent

核心代理,独立分发——可在你自己的虚拟机或容器上运行。

Tokamak

路由器、融合模型以及治理/审计功能——Jan 代理连接的自托管后端。

下载量超过 400 万

Jan 在公开中构建

我们相信人工智能应该是开放的,并通过构建和使用它的人们不断成长。

所有工具,让 Jan 为你所用

1

模型

从开放模型中选择,或插入你最喜欢的在线模型。

ChatGPT

ChatGPT OpenAI

Claude

Claude Anthropic

Gemini

Gemini Google

Llama

Llama Meta

Mistral

Mistral Mistral AI

Qwen

Qwen Alibaba

DeepSeek

DeepSeek DeepSeek

Gemma

Gemma Google

Kimi

Kimi Moonshot AI

2

记忆功能(即将推出)

你的上下文会延续,因此无需重复说明。Jan 会记住你的上下文和偏好。

Joe 的头像

Jan 记住的要点
  • • 喜欢极简界面
  • • 目前正在进行投资组合调整
  • • 希望得到简洁、切中要点的回答
  • • 经常询问 Figma/原型设计问题
  • • 暗色模式爱好者
  • • 对字体趋势感兴趣(大多无害)

向 Jan 提问任何问题

超过 660 万次下载,免费且开源

Perplexity (@perplexity_ai): Portable Computer 现已登陆配备 @NVIDIA RTX 显卡的 Windows PC。

在你的 PC 上本地运行运行环境、代理和模型。

无需将任务发送到云端即可处理本地文件和连接的应用程序。需要时可使用前沿云端模型。

相似文章

数据中心移动到你的设备上(4分钟阅读)

TLDR AI

Perplexity在2026年台北国际电脑展上发布了一款混合本地-云端推理系统,该系统能智能地在设备端模型和云端模型之间路由查询,基于其早前的Personal Computer agent构建。