AI硬件设备

英伟达 IFA 2026 三连发:RTX Spark 小钢炮 10 月开卖,PAIR 让全家电脑组队跑 AI

2026年9月4日2 次阅读
英伟达 IFA 2026 三连发:RTX Spark 小钢炮 10 月开卖,PAIR 让全家电脑组队跑 AI

在柏林 IFA 2026 消费电子展上,英伟达一口气公布了一整套"本地 AI"方案:10 月上市的紧凑型 AI 主机 RTX Spark、能把家里多台电脑 GPU 组队调度的 PAIR 工具,还有最高 1.9 倍的本地推理提速。简单说:以后跑 AI 不一定非得把数据交给云端,自己桌上的显卡就能又快又稳地把活干了。

RTX Spark 是什么?10 月就能买到

RTX Spark 是英伟达面向 AI 玩家和创作者推出的紧凑型 Windows AI 主机(基于此前公布的 N1X 芯片方案),首批整机来自联想和宏碁,10 月正式开卖。它主打的就是"本地跑 AI":体积小、功耗可控,能直接在本地运行大参数开源模型和 AI Agent。

游戏阵营也在跟进:EA、Embark 和育碧等厂商已确认会把自家 3A 大作带上 RTX Spark 平台,让这台"AI 小钢炮"同时也能当游戏主机用。

PAIR:让全家电脑组队跑 AI 的"个人 AI 路由器"

这次发布会最有意思的新工具叫 NVIDIA PAIR(Personal AI Router,个人 AI 路由器)。它解决一个很实际的痛点:家里可能有好几台带显卡的电脑,但每台各干各的,算力浪费严重。

PAIR 做的事情,就是把局域网内多台 PC 的 GPU 组成一个"算力池",智能地把 AI 推理任务分配到最合适的机器上。你在一台笔记本上发起请求,重活可能自动被路由到书房那台 RTX 台式机上——不用手动配置,像路由器分发网络流量一样分发 AI 任务。

推理提速最高 1.9 倍,常用工具直接受益

英伟达还发布了针对 llama.cpp 和 vLLM 的新优化,本地推理速度最高提升 1.9 倍。好消息是,你不需要折腾命令行:这些优化已经通过 LM StudioOllama 这两个最流行的本地模型工具直接推送,装好更新就能享受提速。

同时,Hermes Agent、OpenClaw 和 Perplexity Portable Computer 也宣布简化对英伟达 GPU 的本地 AI 支持——本地 AI Agent 从"会折腾的极客专属"往"开箱即用"又近了一步。

8 月本地 AI 模型已经排起队来

硬件只是半边天,英伟达顺手盘点了一批能跑在这些设备上的新模型:

  • Nemotron 3.5 Lightning:英伟达自家的 300 亿参数模型,RTX PC、RTX PRO 工作站、DGX Spark、Jetson 都能跑
  • GLM-5.3-Flash(智谱):多模态 MoE 模型,可跑在 DGX Station 上
  • Qwen3.8-Flash-Next(阿里通义):开源权重多模态 MoE 模型,DGX Spark / DGX Station 本地运行;还有针对本地 Agent 和编程优化的 Qwen3.8-27B
  • LTX 2.5:开源世界视频生成模型,针对 RTX GPU 优化,新支持 NVFP4 量化
  • MiniMax-H3:带同步音频的开源视频生成模型,通过 ComfyUI 本地运行;英伟达研究员参与蒸馏的四步版 FastH3 性能再提升 7 倍
  • Muse Glimmer(Meta):300 亿参数开源模型,主打编程和 Agent 任务
  • DeepSeek V4 Flash:2840 亿参数 MoE(激活 130 亿),两台 DGX Spark 组网或一台 DGX Station 就能本地跑

对普通用户意味着什么

这套组合拳的核心信号是:本地 AI 正在从"单机折腾"走向"全家组网"。10 月 RTX Spark 上市后,预算有限的用户可以用小主机跑中等规模模型;设备多的人可以用 PAIR 把算力攒起来用;想尝鲜的今天就能通过 LM Studio/Ollama 的更新先吃到 1.9 倍提速。

如果你早就想在本地跑一个不打扰云端、数据不出门的 AI 助手,接下来这几个月可能是入手的好时机。

---

*本文基于英伟达官方博客及新浪财经、网易科技等多家媒体报道整理。*

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...