首页
/
新闻
/
火花四溅:NVIDIA 在 IFA 2026 上加速本地AI
火花四溅:NVIDIA 在 IFA 2026 上加速本地AI
摘要
NVIDIA 在 IFA 2026 上宣布了加速本地AI工具、优化模型和新 RTX Spark 硬件,旨在为开发者和爱好者提供更快、更便捷的本地AI推理。
<div id="bsf_rt_marker"></div><p><span style="font-weight: 400;">前沿智能正在本地化。</span></p>
<p><span style="font-weight: 400;">在 IFA 2026 上,NVIDIA、Microsoft 及其合作伙伴联手提供更快的推理速度和新工具,使智能体更易于在 NVIDIA 硬件上本地设置和运行。新的紧凑型 NVIDIA RTX Spark Windows PC 也将于十月推出,为 AI 爱好者、开发者和创作者提供更多方式本地安全地运行强大的智能体。</span></p>
<p><span style="font-weight: 400;">今天的公告包括:</span></p>
<ul>
<li><span style="font-weight: 400;">简化的本地AI支持将适用于 NVIDIA GPU,包括 Hermes Agent、OpenClaw 和 Perplexity Portable Computer。</span></li>
<li><span style="font-weight: 400;">本地推理速度提升高达1.9倍——新的 llama.cpp 和 vLLM 优化现已直接提供,并通过 LM Studio 和 Ollama 可用。</span></li>
<li><a target="_blank" href="https://www.nvidia.com/en-us/ai-on-rtx/personal-ai-router/"><span style="font-weight: 400;">NVIDIA PAIR</span></a><span style="font-weight: 400;"> — 一个个人AI路由器工具,可智能地将AI推理分配到用户本地网络上的各台PC。</span></li>
<li><span style="font-weight: 400;">NVIDIA RTX Spark 将于十月到来——搭载来自 Lenovo 和 Acer 的新 Windows PC。</span><a href="https://blogs.nvidia.com/blog/gamescom-rtx-spark-pc-games-technology/"><span style="font-weight: 400;">Electronic Arts、Embark 和 Ubisoft</span></a><span style="font-weight: 400;"> 等最新游戏发行商和开发者正将其大作带到 NVIDIA RTX Spark。</span></li>
</ul>
<p><span style="font-weight: 400;">此外,八月对</span><a href="https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/#spark-perplexity"><span style="font-weight: 400;">本地AI</span></a><span style="font-weight: 400;">来说也是一个繁忙的月份:</span></p>
<ul>
<li><b>Nemotron 3.5 Lightning</b><span style="font-weight: 400;"> — 可在 NVIDIA RTX PC、RTX PRO 工作站、DGX Spark 和 Jetson 上运行——是一个已发布的30亿参数模型。立即开始使用 </span><a href="https://blogs.nvidia.com/blog/nemotron-lightning-switchyard-rtx-dgx"><span style="font-weight: 400;">Nemotron 3.5 Lightning</span></a><span style="font-weight: 400;">。</span></li>
<li><b>Z.ai 的 </b><a target="_blank" href="https://z.ai/blog/glm-5.3-flash"><span style="font-weight: 400;">GLM-5.3-Flash</span></a><span style="font-weight: 400;"> 是一个多模态混合专家(MoE)模型,正在将智能体AI引入 DGX Station。</span></li>
<li><b>Qwen</b><span style="font-weight: 400;"> 已发布 </span><a target="_blank" href="https://qwen.ai/blog?id=qwen3.8-flash-next"><span style="font-weight: 400;">Qwen3.8-Flash-Next</span></a><span style="font-weight: 400;">,一个多模态 MoE 开放权重模型,可在 DGX Spark 和 DGX Station 上本地运行,以及 </span><a target="_blank" href="https://huggingface.co/Qwen/Qwen3.8-27B"><span style="font-weight: 400;">Qwen3.8-27B</span></a><span style="font-weight: 400;">,一个27亿参数的开放模型,针对 NVIDIA GPU 上的本地智能体和编码工作负载进行了优化。</span></li>
<li><b>LTX 的 </b><a target="_blank" href="https://ltx.io/model/ltx-2-5"><b>LTX 2.5</b></a><span style="font-weight: 400;"> 是一个开放世界视频生成模型,针对 NVIDIA RTX GPU、DGX Spark 和 DGX Station 进行了优化,具有新的 NVFP4、FastVideo 和 ComfyUI 增强功能,以实现更快、更省内存的本地生成。</span></li>
<li><a target="_blank" href="https://huggingface.co/MiniMaxAI/MiniMax-H3"><b>MiniMax-H3</b></a> <span style="font-weight: 400;">是一个开放权重的视频生成模型,支持同步音频,可通过 ComfyUI 在 NVIDIA GPU 上本地运行。FastVideo 与 NVIDIA 研究人员合作,发布了 FastH3——一个开放权重的四步蒸馏版本,性能提升7倍。针对 NVIDIA RTX GPU 和 DGX Spark 的优化 FastVideo 配方即将推出。</span></li>
<li><b>Meta 的 </b><a target="_blank" href="https://developer.nvidia.com/blog/?p=121045"><b>Muse Glimmer</b></a><span style="font-weight: 400;"> 是一个30亿参数的开放权重模型,适用于编码和智能体工作负载,可在 GeForce RTX PC、DGX Spark、DGX Station 和 Jetson 上本地运行。NVIDIA 还发布了 </span><a target="_blank" href="https://huggingface.co/nvidia/Muse-Glimmer-30B-NVFP4"><span style="font-weight: 400;">NVFP4 量化</span></a><span style="font-weight: 400;">,支持 DGX Spark,以实现更省内存的本地部署。</span></li>
<li><a target="_blank" href="https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731"><b>DeepSeek v4 Flash</b></a><span style="font-weight: 400;"> 是一个284亿参数的 MoE 模型,具有13亿活跃参数,可在2x DGX Spark 集群和 DGX Station 上本地运行。</span></li>
</ul>
<h2><b>本地智能体更简单的开端</b></h2>
<p><span style="font-weight: 400;">让本地智能体与本地模型一起运行曾需要一些努力——选择模型、找到兼容的推理服务器、调整量化设置并保持一切更新。这种摩擦在 RTX 和 DGX 系统上正在消失。</span></p>
<p><span style="font-weight: 400;">三个最广泛使用的智能体应用将在 Windows 上提供简化的本地模型设置,每个都基于 llama.cpp 构建,并融入 NVIDIA 最新的推理优化。新的设置体验旨在减少手动配置,使本地智能体更容易启动和运行。</span></p>
<p><span style="font-weight: 400;">上个月,Perplexity 推出了其 </span><a target="_blank" href="https://www.perplexity.ai/hub/blog/introducing-portable-computer-for-local-first-ai"><span style="font-weight: 400;">Portable Computer 智能体</span></a><span style="font-weight: 400;">,为用户提供了一种简单的方式,在 Linux 系统(如 </span><a target="_blank" href="https://www.nvidia.com/en-us/products/workstations/dgx-spark/"><span style="font-weight: 400;">NVIDIA DGX Spark</span></a><span style="font-weight: 400;">)上本地运行 Perplexity,将模型、编排和工具打包成单一应用体验。</span></p>
<p><span style="font-weight: 400;"><b>Perplexity Portable Computer</b> 现在可在具有至少24GB显存的 NVIDIA RTX GPU 上运行 Linux,Windows 支持即将推出,将同样的简化设置带给更广泛的PC用户。用户可以本地运行完整工作流,无需消耗积分,同时在需要额外研究或推理时,选择将部分任务升级到15+个前沿云端模型之一。Portable Computer 在发送内容到云端前会请求许可,帮助用户将敏感信息保留在设备上。以下是一些使用案例:</span></p>
<ul>
<li><b>工程:</b><span style="font-weight: 400;">在连接的 GitHub 仓库中审查开放 PR,并将它们分类为就绪、阻塞、过时和需要审查,每个都标记下一步。与最新合并不同步的文档会被发现并修复,并为更改打开 PR。</span></li>
<li><b>金融:</b><span style="font-weight: 400;">指向代理的两年经纪摘要、合并1099表格和纳税申报表,让它追踪产生最多可避免费用和税收拖累的重复持仓,每个数字都引用到确切的文件和页面——所有内容都无需文档到达聊天机器人。</span></li>
<li><b>初创公司:</b><span style="font-weight: 400;">询问激活为何持平,代理在本地分析漏斗导出,找出新注册用户在安装和首次完成任务之间的流失点,然后将主要见解直接发布到团队的 Slack 频道。</span></li>
</ul>
<p><span style="font-weight: 400;">试用 </span><a target="_blank" href="https://www.perplexity.ai/hub/products/portable-computer"><span style="font-weight: 400;">Perplexity Portable Computer</span></a><span style="font-weight: 400;">。</span></p>
查看缓存全文
缓存时间:
2026/09/03 17:49
# 火花四溅:NVIDIA 在 IFA 2026 上加速本地 AI
来源:https://blogs.nvidia.com/blog/local-ai-ifa-next-gen-agents-nv-pair-rtx-spark/
前沿智能正在走向本地。在 IFA 2026 上,NVIDIA、微软及其合作伙伴联手提供更快的推理能力和新工具,让智能体更容易在本地 NVIDIA 硬件上设置和运行。全新的紧凑型 NVIDIA RTX Spark Windows PC 也将于十月上市,为 AI 爱好者、开发者和创作者提供更多本地安全运行强大智能体的方式。
今日公告包括:
- 支持 NVIDIA GPU 的简化本地 AI 支持即将在 Hermes Agent、OpenClaw 和 Perplexity Portable Computer 中推出。
- 最高 1.9 倍的本地推理加速——全新的 llama.cpp 和 vLLM 优化现已通过 LM Studio 和 Ollama 直接提供。
- NVIDIA PAIR(https://www.nvidia.com/en-us/ai-on-rtx/personal-ai-router/)——一款个人 AI 路由工具,可智能地在用户本地网络中的 PC 上分配 AI 推理任务。
- NVIDIA RTX Spark 将于十月登场——联想和宏碁将推出新款 Windows PC。Electronic Arts、Embark 和 Ubisoft(https://blogs.nvidia.com/blog/gamescom-rtx-spark-pc-games-technology/)是众多将大作带到 NVIDIA RTX Spark 的游戏发行商和开发者中的最新成员。
此外,八月对本地 AI(https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron/#spark-perplexity)来说也是繁忙的一个月:
- **Nemotron 3.5 Lightning**——可在 NVIDIA RTX PC、RTX PRO 工作站、DGX Spark 和 Jetson 上运行——这是一款拥有 300 亿参数的模型,现已发布。立即开始使用 Nemotron 3.5 Lightning(https://blogs.nvidia.com/blog/nemotron-lightning-switchyard-rtx-dgx)。
- **Z.ai 的** GLM-5.3-Flash(https://z.ai/blog/glm-5.3-flash)是一款多模态混合专家(MoE)模型,正将智能体 AI 引入 DGX Station。
- **Qwen** 已发布 Qwen3.8-Flash-Next(https://qwen.ai/blog?id=qwen3.8-flash-next),这是一款开放权重的多模态 MoE 模型,可在 DGX Spark 和 DGX Station 上本地运行,同时还有 Qwen3.8-27B(https://huggingface.co/Qwen/Qwen3.8-27B),这是一款针对 NVIDIA GPU 上本地智能体和编码工作负载优化的 270 亿参数开放模型。
- **LTX 的 LTX 2.5**(https://ltx.io/model/ltx-2-5)是一款针对 NVIDIA RTX GPU、DGX Spark 和 DGX Station 优化的开放世界视频生成模型,具有全新的 NVFP4、FastVideo 和 ComfyUI 增强功能,可实现更快、更节省内存的本地生成。
- **MiniMax-H3**(https://huggingface.co/MiniMaxAI/MiniMax-H3)是一款具有同步音频的开放权重视频生成模型,可通过 ComfyUI 在 NVIDIA GPU 上本地运行。FastVideo 与 NVIDIA 研究人员合作,发布了 FastH3——一个开放权重的四步蒸馏版本,将性能提升了 7 倍,进一步改善了这一点。针对 NVIDIA RTX GPU 和 DGX Spark 优化的 FastVideo 方案即将推出。
- **Meta 的 Muse Glimmer**(https://developer.nvidia.com/blog/?p=121045)是一款拥有 300 亿参数的开放权重模型,专为编码和智能体工作负载设计,可在 GeForce RTX PC、DGX Spark、DGX Station 和 Jetson 上本地运行。NVIDIA 还发布了 NVFP4 量化(https://huggingface.co/nvidia/Muse-Glimmer-30B-NVFP4)并支持 DGX Spark,以实现更节省内存的本地部署。
- **DeepSeek v4 Flash**(https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731)是一款拥有 2840 亿参数的 MoE 模型,具有 130 亿活跃参数,可在 2x DGX Spark 集群和 DGX Station 上本地运行。
## **本地智能体更简单的开始**
让本地智能体使用本地模型启动并运行曾经需要一些努力——选择模型、寻找兼容的推理服务器、调整量化设置并保持一切更新。在 RTX 和 DGX 系统上,这种摩擦正在消失。
三个使用最广泛的智能体应用将为 Windows 提供简化的本地模型设置,每个应用都基于 llama.cpp 构建,并集成了 NVIDIA 最新的推理优化。新的设置体验旨在减少手动配置,让本地智能体更容易启动和运行。
上个月,Perplexity 推出了其 Portable Computer 智能体(https://www.perplexity.ai/hub/blog/introducing-portable-computer-for-local-first-ai),为用户提供了一种简单的方式,在 Linux 系统(如 NVIDIA DGX Spark(https://www.nvidia.com/en-us/products/workstations/dgx-spark/))上本地运行 Perplexity,模型、编排和工具被打包成一个应用体验。
**Perplexity Portable Computer** 可在运行 Linux、拥有至少 24GB 显存的 NVIDIA GPU 上使用,Windows 支持即将推出,将这种流畅的设置带给更广泛的 PC 用户群体。用户可以本地运行完整的工作流程,无需消耗积分,同时当需要额外的研究或推理时,可以选择性地将任务的部分内容升级到 15 个以上的前沿云端模型之一。Portable Computer 在将内容发送到云端前会请求许可,帮助用户将敏感信息保留在设备上。以下是一些用例示例:
- **工程:** 审阅连接的 GitHub 仓库中的开放 PR,并将它们分类为就绪、阻塞、过时和需要审阅,每个都标记下一步操作。与最新合并不同步的文档会被发现并修复,并为这些更改开启一个 PR。
- **金融:** 将智能体指向两年的经纪摘要、合并的 1099 表格和纳税申报表,让它追踪造成最多可避免费用和税收拖累的持续持仓,每个数字都引用到确切的文件和页面——而无需任何文档到达聊天机器人。
- **初创公司:** 询问激活为何停滞,智能体在本地分析漏斗导出,找出新注册用户在安装和首次完成任务之间流失的地方,然后将最重要的见解直接发布到团队的 Slack 频道。
立即试用 Portable Computer(https://www.perplexity.ai/hub/products/portable-computer)。
**Hermes Agent — 由 Nous Research(https://nousresearch.com/)开发** — 是一款通用智能体,被数百万人使用,以可靠性和自我改进能力著称。模型和提供商无关的 Hermes 旨在本地系统上全天运行,使 RTX PC、RTX PRO 工作站和 DGX Spark 成为自然的选择。
在 Hermes 中配置本地模型将为用户提供在 Windows 上一键设置 RTX 和 DGX 系统的功能。智能体将自动检测 NVIDIA GPU,选择适当的模型和配置,并通过集成的 llama.cpp(其中已包含 NVIDIA 推理优化)运行它,无需手动下载和调整模型。Linux 支持即将推出。
一旦运行,Hermes 的工作方式与其他地方相同。它使用工具,跨任务保持上下文,在会话之间记住信息,并随着时间的推移创建可重用的技能,使智能体在持续使用中变得更强大。在 GPU 上本地运行模型可保持性能快速,同时将数据保留在系统上。
一键本地模型设置现已在 Windows 上可用,Linux 支持即将推出。了解更多关于 Hermes Agent(https://hermes-agent.nousresearch.com/)的信息。
**OpenClaw**(https://openclaw.ai/)已成为开放智能体运动的标志性项目之一——GitHub 上最大的 AI 项目,拥有超过 380K 星标,并拥有一个快速发展的社区,正在构建涵盖研究、工程、项目管理和日常生产力的工具和技能。
NVIDIA、微软和 OpenClaw 一直合作,使该体验在 Windows PC 上更容易设置。为了减少入门摩擦,OpenClaw Windows 应用程序简化了在任何拥有至少 24GB 显存的 RTX GPU 上设置优化本地模型的过程。
在 OpenClaw 博客中了解更多。
## **更快的推理为本地智能体助力**
推理性能对于保持本地智能体的响应速度至关重要。NVIDIA 继续与开源 llama.cpp 和 vLLM 社区合作,加速跨本地 NVIDIA 平台的智能体工作负载。
llama.cpp 通过在 GeForce RTX 5090 上的内核优化、增强的推测解码技术和更快的预填充,可提供高达 1.9 倍的更高吞吐量。
vLLM 在 RTX PRO 6000 Blackwell 工作站版(https://www.nvidia.com/en-us/products/workstations/professional-desktop-gpus/rtx-pro-6000/)上提供 1.2 倍,在两个 DGX Spark 集群上提供高达 1.4 倍。FlashInfer 中新的 XQA 注意力内核和后端优化有助于在两个平台上加速推理。
这些增益可在 llama.cpp 和 vLLM 推理后端上获得。
用户也可以通过 LM Studio 和 Ollama 应用程序体验这些。
## **利用闲置 PC 获取更多本地 AI 算力 NVIDIA PAIR**
超过一半的美国家庭拥有两台或更多 PC,而其中大部分计算能力在一天中大部分时间都处于闲置状态。NVIDIA Personal AI Router (PAIR)(https://www.nvidia.com/en-us/ai-on-rtx/personal-ai-router/)是一款免费的开源软件工具,可将这些系统联合起来用于本地 AI。
智能体工作流通常将复杂任务分解为可并行运行的较小作业,但当每个请求都在竞争同一个 GPU 时,性能可能会变慢。PAIR 自动发现本地网络上的兼容 PC,并将独立的推理请求路由到有容量的系统。它支持 Ollama 和 LM Studio,并且可以随着设备加入或离开网络而适应。
例如,用户可以要求 Hermes 通过整理杂乱的收件箱并优先处理需要立即关注、可以等待以及可以跳过的内容,来创建一个“周日重置”计划。Hermes 可以将该工作分配给多个子智能体,而 PAIR 将这些作业分布到可用的 PC 上,而不是让它们全部等待在单个 GPU 上。
结果是为本地智能体提供更多算力,更多任务并行运行,并且具有将 AI 工作负载移动到另一台 PC 的灵活性,而主系统则用于游戏、创作或其他工作。
NVIDIA PAIR Beta 版现已通过图形界面和终端界面在 Windows、macOS 和 Linux 上提供,支持 NVIDIA GeForce RTX 20 系列 GPU 及更新版本、NVIDIA RTX PRO 工作站 GPU(https://www.nvidia.com/en-us/products/workstations/professional-desktop-gpus/)(Turing 架构及更新版本)、NVIDIA DGX Spark 和 Apple M4 或更新的硅芯片。
查看 NVIDIA 技术博客(http://developer.nvidia.com/blog/nvidia-pair-virtual-inference-router-expands-available-compute-on-your-local-network)开始使用 NVIDIA PAIR。
## **通过 Cyberlink PhotoDirector AI PC 模式在 RTX Spark 上实现强大的设备端照片编辑**
开放的图像和视频模型使艺术家能够在 PC 上尝试 Creative AI 模型。这使艺术家能够迭代和探索概念与想法,而无需担心令人头疼的 token 焦虑,并将更多创意作品保密并保留在设备上。
讯连科技全新的 PhotoDirector AI PC 模式是最早将这些扩散模型直接集成到创意软件中,并将其转化为艺术家指尖上创意工具的应用程序之一。它将在十月与 NVIDIA RTX Spark 一同推出,并针对该设备进行优化。AI PC 模式用户将获得 AI 驱动的编辑工具,用于生成式编辑、图像增强、对象和干扰物移除、背景移除和替换、人像精修以及全新视觉内容的创建——并能够根据任务需求在本地处理或云处理之间灵活选择。
在 NVIDIA GPU 上,PhotoDirector 使用 TensorRT-RTX 和 FP8 来加速本地 AI。
开始使用讯连科技的 PhotoDirector 365 照片编辑软件(https://www.cyberlink.com/products/photodirector-photo-editing-software-365/overview_en_US.html)并了解更多关于 PhotoDirector AI PC 模式的信息,该模式将与 RTX Spark 在十月一同推出。
## **NVIDIA RTX Spark Windows PC 将于 2026 年十月上市**
NVIDIA RTX Spark(https://www.nvidia.com/en-us/products/rtx-spark/)将于十月推出——在 IFA 2026 上,合作伙伴正在展示他们的硬件。在 IFA 上,新公布的设计加入了十月出货的现有六家 OEM 厂商。宏碁展示了其紧凑型桌面 RTX Spark 概念机,联想宣布了其 Yoga Pro 9n 和 Yoga 9n 二合一设备。
RTX Spark 是 Windows PC 的新起点。一台为创作者、游戏玩家和智能体打造的 PC。凭借强大的 1 Petaflop RTX Blackwell GPU、高达 128GB 的统一内存和高能效的 20 核 Grace CPU,RTX Spark 带来了令人惊叹的性能和效率。这款超级芯片实现了全天候电池续航的高性能轻薄笔记本电脑和紧凑型桌面机,为始终在线的智能体提供动力。结合全新的 Windows Agent 框架,它能够在操作系统级控制下安全地在后台运行智能体。
上周在 Gamescom 上,Electronic Arts、Embark 和 Ubisoft 是众多将大作带到 NVIDIA RTX Spark Windows PC 的游戏发行商和开发者中的最新成员。他们加入了五月份在 COMPUTEX 上宣布支持 RTX Spark 的发行商,包括 KRAFTON、网易、Riot Games 和 XBOX。阅读更多(https://blogs.nvidia.com/blog/gamescom-rtx-spark-pc-games-technology/)。
注册(https://www.nvidia.com/en-us/products/rtx-spark/#notify-me)以在 RTX Spark 笔记本电脑和桌面机上市时收到通知。
## **\#ICYMI:NVIDIA 本地 AI 的更多更新**
🎮**NVIDIA 在 Gamescom 上带来全新 RTX 技术和游戏**— NVIDIA 发布了 DLSS 4.5 光线重建(https://www.nvidia.com/en-us/geforce/news/gamescom-2026-nvidia-geforce-rtx-dlss-4-5-announcements/?utm_source=chatgpt.com),采用全新的第二代 Transformer 模型,可在光线追踪和路径追踪游戏中提升图像质量。Gamescom 还发布了针对 007 First Light、CONTROL Resonant 和 Gears of War: E-Day 等游戏的新 RTX 公告(https://blogs.nvidia.com/blog/gamescom-rtx-spark-pc-games-technology/),并扩大了对即将推出的 NVIDIA RTX Spark 的游戏支持。
**🐋 介绍 DeepSeek Harness —** DeepSeek 全新的开源 harness(https://github.com/deepseek-ai/deepseek-harness)与 DeepSeek-V4-Flash(https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731)配合使用,可在 NVIDIA DGX Station 和多 DGX Spark 设置上支持本地智能体编码工作流。
📊**MLPerf Client v2.0 扩展 AI PC 基准测试**— MLCommons 发布了 MLPerf Client v2.0(https://mlcommons.org/2026/08/mlperf-client-v2-0/),与 NVIDIA 和其他行业领导者合作开发。此次更新增加了针对智能体 AI 和图像生成的新基准测试,以及扩展的 LLM 测试,用于真实的本地 AI 工作负载。
*在**X* (https://x.com/NVIDIARTXSpark)、**Instagram* (https://www.instagram.com/nvidiartxspark/)、**TikTok* (https://www.tiktok.com/@nvidiartxspark) 和 **Facebook* (https://www.facebook.com/NVIDIARTXSpark) 上关注 NVIDIA RTX Spark — 并订阅 **NVIDIA Local AI 通讯* (https://www.nvidia.com/en-us/ai-on-rtx/?modal=subscribe-ai) 以获取最新信息。在 **LinkedIn* (https://www.linkedin.com/showcase/3761136/) 和 **X* (https://x.com/NVIDIAworkstatn) 上关注 NVIDIA Workstation。
*查看关于软件产品信息的**公告* (https://www.nvidia.com/en-eu/about-nvidia/terms-of-service/)*。*
相似文章
NVIDIA Blog
NVIDIA 与谷歌合作优化 Gemma 4 模型,以实现在 RTX GPU、DGX Spark 和 Jetson 设备上的本地部署,从而支持高效的端侧智能体 AI,具备推理、编程、多模态能力以及 35 多种语言的支持。
NVIDIA Blog
NVIDIA 发布了 RTX Spark PC 和一系列更新,以在 RTX 和 DGX 生态系统中支持本地 AI 智能体,包括 OpenShell 运行时即将登陆 Windows、NemoClaw 扩展、性能提升以及与 Adobe 和 H Company 的集成。
NVIDIA Blog
NVIDIA highlights a wave of open source AI model and tool releases for local deployment, including Cosmos 3 Edge, MiniMax-H3, Laguna S 2.1, DeepSeek-V4-Flash, Inkling-Small, and Unsloth Desktop, celebrating the community driving local AI forward.
X AI KOLs Timeline
NVIDIA在IFA上宣布了PAIR,这是一个工具,可自动链接本地网络系统,分配推理请求,以实现高效的AI代理操作。
X AI KOLs Following
开发者反思在Nvidia上轻松进行本地AI任务,与在Apple Silicon上成功让一切运转的满足感对比,倡导‘保持饥饿,保持愚蠢’的心态。