
【CNMO科技消息】在IFA 2026展会上,英伟达公布了面向本地AI推理的多项软硬件更新,回应了过去一年本地大语言模型下载量显著增长的市场趋势。
英伟达
针对本地AI配置繁琐的痛点,英伟达宣布从9月起推出一键安装功能。持有RTX系列显卡及DGX系统的用户,将可在Hermes Agent与OpenClaw 2.0中直接完成模型配置,无需手动调整推理引擎或量化参数。Perplexity也将面向配备24GB及以上显存RTX显卡的用户,推出便携式AI助手服务,用户可选择将敏感数据留在本地处理,复杂问题则转至云端处理。此外,英伟达披露了本地推理性能提升数据:Blackwell与DGX Spark系统在Llama.cpp中吞吐量最高提升1.9倍,在vLLM中最高提升1.4倍。
英伟达同步推出了免费开源工具Nvidia Pair(Personal AI Router),于9月3日正式发布,采用Apache 2.0许可证开源。该工具可将AI推理任务分散至局域网内多台闲置PC协同完成,支持Windows、Linux与macOS系统,通过Ollama与LM Studio代理运行。Pair会根据各台设备的任务队列深度与GPU占用率动态分配计算任务,让游戏主机、副屏笔记本等闲置算力得以利用,且不会干扰用户正在进行的游戏或渲染工作。
硬件方面,英伟达公布了RTX Spark架构首款芯片N1X的详细规格,将于10月上市,提供两种配置。高端版本配备6144核GPU、20核Grace CPU,笔记本电脑与紧凑型台式机版本最高支持128GB统一内存;另一版本则配备5120核GPU、18核Grace CPU,最高支持32GB统一内存。英伟达同时确认,包括《Apex英雄》《The Finals》《Anno 117:帕克斯罗马纳》在内的多款主流游戏已加入反作弊及原生Spark平台支持。
景盛网提示:文章来自网络,不代表本站观点。