
英伟达发布了一款开源软件,叫Personal AI Router,简称PAIR。你可以把它理解成一个给AI跑腿分配任务的调度员:只要电脑在同一个局域网里,谁闲着,任务就派给谁。
以前在本地跑AI,每台机器都得单独配置。你有一台Mac和一台RTX PC,就得分别在两台上装Ollama、LM Studio,还要想清楚哪个模型放哪。现在PAIR自动帮你发现网络里的设备,收到AI请求后直接塞给有空余算力的那台。模型还是由目标机器上的Ollama或LM Studio运行,用户不用为了每一款应用去改每台电脑的配置。
PAIR适合什么场景?举个例:你让AI智能体同时读五份合同。这五个任务彼此独立,完全可以让五台电脑各读一份,而不是挤在一台上排队。某台电脑正忙着,PAIR就把新请求转向别的空闲设备。
注意,它提的是“并发负担分摊”,不是“单个AI回复变快”。一个对话请求只能由一台电脑处理,接再多机器也不会把一句话算得更快。它的优势在于同时处理多个任务时,总耗时被压缩。
英伟达给了一组实测数据: