NVIDIA在IFA上发布了一个新项目PAIR,它做的事情很直接:把同一本地网络里的多台设备自动连起来,然后把推理请求分配给那些算力空闲的设备。这样一来,智能体在本地跑起来时,不再只依赖单一设备,而是能“借用”周围设备的算力

这个思路解决的是一个现实问题:单个设备的功耗和内存/算力瓶颈,正在限制智能体的普及。Perplexity CEO Aravind Srinivas转发时评论说,需要更多这类项目来解决这些瓶颈。

打开网易新闻 查看精彩图片

PAIR的核心逻辑

它不依赖云端,而是在本地网络内做调度。设备之间自动发现、自动连接,推理请求被动态分配到有空闲算力的机器上。对于多设备在手的用户来说,相当于把闲置算力利用了起来。

目前PAIR刚发布,具体效果和适配范围还有待验证。但方向很明确:让智能体在本地跑得更顺,而不是什么都往云端送。