RTX 5090用户狂喜!英伟达免费送1.9倍AI性能:本地跑模型再也不用折腾
快科技9月4日消息,英伟达在IFA 2026上宣布多项本地AI重大升级。三款主流智能体应用Hermes Agent、OpenClaw和Perplexity Portable Computer将支持Windows一键本地部署。用户无需手动下载模型或调整参数,程序自动检测GPU并完成配置。

在性能提升上,llama.cpp(大语言模型推理框架)最新优化在GeForce RTX 5090上实现最高1.9倍推理吞吐提升。Qwen3.6-27B模型token吞吐量提升50%,Qwen3.6-35B加速达90%。
与此同时,推理框架vLLM在RTX PRO 6000 Blackwell上实现了20%的速度提升,双DGX Spark集群则达到1.4倍提升。

除了让已有模型跑得更快,英伟达还大幅降低了本地AI的部署门槛。Perplexity Portable Computer将于9月登陆Windows和Linux平台,提供一键本地部署功能,不过需要配备24GB及以上显存的英伟达GPU。
完成本地部署后,用户可在本地完整运行工作流,不消耗积分,必要时才将部分任务提交云端,且上传前需获得用户许可。
Perplexity只是本次支持一键部署的三款应用之一。Hermes Agent由Nous Research开发,是通用型智能体。配置完成后可调用工具、跨任务保持上下文、跨会话记忆信息并随时间积累可复用技能。OpenClaw号称GitHub最大AI项目,已获超38万星标。
英伟达同步开放NVIDIA PAIR工具测试版。该工具可自动发现家庭局域网内所有兼容PC,将独立推理请求路由至空闲算力设备,实现多机协同推理。此外,PAIR还兼容Windows、macOS和Linux,支持RTX 20系列及更新GPU。

编辑:红茶
【本文结束】如需转载请务必注明出处:快科技
