财联社9月4日讯(编辑 史正丞)随着轻量化AI模型的快速迭代,算力巨头英伟达正在抓紧布局“个人本地AI”赛道的一系列软硬件产品。
英伟达周四发布公告称,NVIDIA RTX Spark设备将于今年10月开始出货。
这款电脑的核心卖点正是英伟达的N1X芯片。为了能在本地跑AI,这款芯片支持最高128GB的统一内存,芯片搭载的Blackwell GPU能够提供最高每秒千万亿次浮点运算能力。
周四的最新消息也确认,N1X芯片有两个版本,核心差异依然是内存规格。
其中,“满血”版N1X芯片配备6144个CUDA核心的Blackwell GPU,以及20核Grace CPU,支持24GB至128GB的统一内存,用于超高端笔记本电脑和桌面紧凑型主机。
另一个规格的N1X芯片GPU核心降至5120个,CPU核心降至18个,同时只支持24GB至32GB的统一内存。考虑到32GB显存只能跑得动约300亿参数量的模型,这个版本的配置更像是传统游戏本。
目前仍不清楚N1X产品线的定价情况,但鉴于“内存浩劫”依然笼罩消费电子市场,可以预期下个月上架的新一代AI PC势将价格不菲。
随着消费者手上能在本地跑AI的设备越来越多,充分利用家庭算力这件事,也被英伟达放上台面。
公司周四宣布,推出开源个人AI路由器软件NVIDIA PAIR(Personal AI Router),用来同步家里的“一众电脑”,处理本地AI推理任务。
PAIR可以自动发现同一网络中的兼容电脑,将这些设备连接起来,协同处理本地智能体的算力需求。通过这款软件,英伟达还顺手把苹果算力设备拉进了自己的体系。
据悉,目前兼容设备主要包括搭载英伟达显卡的电脑,包括RTX 20系列及之后的显卡,以及RTX Pro GPU和DGX Spark系统。同时,搭载苹果M4或更新芯片的设备也可以使用。
这款应用的关键之处在于,它会优先利用家中设备的空闲算力,尽量避免影响设备正在执行的其他任务。英伟达还表示,PAIR能够随着设备加入或离开网络自动调整计算资源。例如,当用户开始在台式电脑上玩游戏时,PAIR可以相应减少或停止使用这台电脑的算力。
在媒体简报会上,英伟达产品经理塞斯·施奈德表示,公司设想中的PAIR用户会拥有一套类似“MacBook/Windows笔记本电脑加一台游戏PC”的配置。
施奈德还描绘了这样一个场景:父亲拥有一台RTX Spark笔记本和一台DGX Spark台式机,母亲使用RTX 5090笔记本,女儿有一台游戏台式机,儿子则使用MacBook Pro。
施奈德估算,在这个相当极端的案例中,该家庭拥有大约165万亿次浮点运算/秒(165 TFLOPS)的未充分利用算力。他表示:“如今散落在千家万户里的这些闲置算力,实际上就是一座免费的词元宝库。”
演示测试中,在使用千问3.6 35B A3B模型时,如果仅在一台英伟达Spark笔记本上运行,完成一项智能体任务平均需要18分钟。
相比之下,由一台RTX Spark笔记本、一台DGX Spark和一台RTX 5090设备组成的三设备PAIR集群,平均仅需8分48秒即可完成,耗时缩短约一半。
除了PAIR外,英伟达还宣布,三款主要AI智能体应用(Perplexity Portable Computer、Hermes Agent和OpenClaw)将获得更简化的本地部署方式。新的安装体验旨在让用户只需点击几下,就能在本地完成AI智能体的部署并启动运行。
(财联社 史正丞)
热门跟贴