会懂网AI资讯,9月4日,英伟达在IFA 2026线上会议公布了三项面向本地AI的创新:联合Hermes Agent、OpenClaw 2.0与Perplexity便携智能体上线“一键本地AI”功能;开源工具NVIDIA Pair激活家庭闲置设备算力;以及首款专为AI智能体定制的RTX Spark芯片将于10月上市。

“一键本地AI”的路径很清晰:9月起,Hermes Agent覆盖Windows、Linux与全系RTX、DGX设备,OpenClaw 2.0月底上线Windows版一键部署。用户不再需要手动配置模型与运行环境,智能体可以被“开箱即用地”装进本地机器。
NVIDIA Pair则把视角伸向局域网:它开源了一套机制,让家庭中闲置的设备在局域网内跨机器共享GPU推理资源。这实际上是把“分布式算力”从数据中心下放到家庭与工作室,用闲置硬件拼出一张低成本、低延迟的本地推理网络。
RTX Spark芯片是这套战略的硬件支点:首款专为AI智能体定制,瞄准本地Agent的普及化。统计显示,今年前8个月Hugging Face Top20模型下载量已突破13亿次,达到去年全年的4倍——本地部署与混合推理,正成为云端Token降本之外最现实的方案。
会懂网判断,当云端大模型的Token价格因竞争腰斩,英伟达却在把战场往“端侧与局域网”拉,用硬件、软件与生态的三位一体抢占本地Agent的TCO拐点。这背后的逻辑是:算力竞争的下半场,比的不是谁的单卡更强,而是谁能把算力像水电一样,铺到每一台设备旁边。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END





















暂无评论内容