英伟达通过全新开源模型加速DGX与RTX系统AI性能

发布的主要亮点:
通过NVIDIA Sync Cluster Assistant扩展DGX Spark —— 将两台或更多系统连接成高速集群,具备简化的网络、工作负载路由和健康监控功能。
从DGX Spark获取更多功能 —— Google Chrome将以原生ARM64 Linux版本推出,全新的NVIDIA Sync Resource Monitor将提供跨单系统或整个集群的实时及历史CPU和GPU视图。
在本地运行Meta的Muse Glimmer —— 这款300亿参数的开源权重模型针对始终在线的本地智能体进行了优化,在RTX 5090上每秒可生成超过200个token。
使用LTX-2.5在本地创作高质量视频 —— 这款开源视频模型新增多镜头生成和生成式编辑功能,在NVIDIA RTX GPU、DGX Spark和DGX Station上性能提升2倍,显存节省40%。
探索更多由英伟达加速的开源模型 —— 包括Cosmos 3 Edge、MiniMax-H3、Poolside的Laguna S 2.1、DeepSeek-V4-Flash、Thinking Machines Lab的Inkling-Small、Unsloth Desktop和Wan-Animate。

从新增的开源模型支持开始,英伟达的DGX和RTX平台现已全面支持Cosmos 3 Edge(40亿参数)、MiniMax-H3(330亿参数)、Laguna S 2.1(1180亿参数)、DeepSeek V4-Flash(2840亿参数)、Wan-Animate-2(140亿参数)和Inkling-Small(2760亿参数)等AI模型。
英伟达还新增了对Unsloth Desktop的支持,该应用今日发布,在完全开源的桌面应用中增加了本地模型推理、图像/视频扩散生成、微调、智能体集成、网络研究和代码执行等功能。
英伟达的RTX平台,如RTX 5090和RTX PRO 5000 Blackwell,在运行Wan-Animate-2时,性能分别比Apple M3 Ultra提升高达26倍和16倍,为用户提供了一个开源权重模型,可将驱动视频中的动作和面部表情迁移到静态角色图像上。

LTX-2.5是一款全新的视频生成模型,其特点是配备了一种新的扩散视频解码器,该解码器与变分自编码器(VAE)视频解码器相辅相成,通过提供第二条解码路径来实现更高质量的最终渲染,从而提升视频质量。
在LTX 2.5中,RTX PRO 6000 96 GB GPU在创作视频时可带来20%的性能提升和40%的显存节省。用户还可以利用英伟达的NVFP4、FastVideo和ComfyUI,以增强文本生成视频、图像生成视频和视频生成视频的能力。

Meta也在发布Muse Glimmer,这是其最新的300亿参数开源权重模型,拥有12万+的上下文窗口,专为编程和智能体AI而设计。该模型针对英伟达的RTX和DGX系统进行了优化,同时支持英伟达的Jetson平台,在单张RTX 5090 GPU上可实现超过200 TPS(每秒token数)。Muse Glimmer的一些功能包括:
自定义智能体:针对特定任务、工具、数据和专业领域调整模型。
私有数据处理:读取、总结本地文件、文档、电子**和消息,并据此执行操作。
凭证处理:在设备端保持推理的同时,使用应用程序编程接口(API)密钥、身份验证令牌和其他敏感信息。
多步骤任务:完成多个顺序工具调用,并从错误或意外结果中恢复。
长时间运行的工作流:将大型项目分解为多个步骤,跟踪进度,并在上下文完整的情况下恢复中断的会话。

针对DGX Spark,英伟达有几项重大更新。首先是全新"NVIDIA Sync Cluster Assistant"的发布,它让将多台DGX Spark PC集群化变得更加容易,从而增加内存、推理和计算容量以运行更大的模型。该功能在Windows和macOS上均可用。
DGX Spark还将获得原生ARM64 Linux版本的Google Chrome,可直接从DGX OS上的DGX Dashboard进行安装。此外还推出了全新的NVIDIA Sync Resource Monitor,可为单台或集群化的DGX Spark系统提供CPU和GPU使用情况的实时及历史视图。
