在近期举行的NVIDIA GTC大会上,英伟达CEO黄仁勋发布了新一代AI图形技术DLSS 5,并将其称为“图形领域的GPT时刻”。这一评价引发了业界的广泛关注,因为它预示着计算机图形的实现方式正迎来一场根本性的变革。
黄仁勋之所以做出如此高的评价,是因为DLSS 5的核心理念与GPT等大型语言模型的突破有相似之处。正如GPT通过大规模训练涌现出对语言的深层理解能力,DLSS 5也通过AI训练,让渲染模型涌现出对光照、材质和场景语义的深度理解。它不再像以往的图形技术那样完全依赖人工编写的物理规则和算法来模拟现实,而是将传统的、结构化的3D图形数据与能够预测和生成画面细节的生成式AI模型相结合。这种融合标志着图形技术从“手工规则驱动”向“AI生成增强”的范式转变。
在DLSS 5之前,DLSS技术(深度学习超级采样)的主要目标是作为一种性能工具,通过AI超分辨率和帧生成技术,让游戏在不牺牲过多画质的前提下运行得更快。而DLSS 5则将重心从“AI辅助性能”转向了“AI重塑画质”,致力于解决一个困扰行业数十年的难题:如何在游戏有限的实时渲染时间内(通常每帧仅有16毫秒),实现接近好莱坞电影级别的视觉真实感。

DLSS 5的亮点主要体现在以下几个方面:
其核心是引入了实时神经网络渲染模型。这项技术不再仅仅是修补或生成像素,而是对游戏画面进行实时的光照与材质“重绘”。它接收游戏引擎输出的每一帧色彩和运动矢量信息,然后利用一个经过端到端训练的AI模型,为场景实时注入照片级写实的光照与材质效果。

DLSS 5的AI模型具备深度的场景理解能力。它仅需分析单帧图像,就能理解复杂的场景语义,例如区分角色的皮肤、头发、织物等不同材质,并能判断顺光、逆光或阴天等环境光照条件。基于这种理解,DLSS 5能够精准生成以往只有在耗费数小时渲染一帧的电影特效中才能看到的复杂视觉效果,比如皮肤的次表面散射、织物细腻的光泽变化、光线穿过发丝的微妙折射等,极大地提升了画面的真实感。

再者,与Sora等视频生成AI不同,DLSS 5在生成画面的同时,保证了可控性、一致性和实时性。游戏画面要求每一个像素都是确定且可控的。DLSS 5生成的效果会牢牢锚定在游戏原有的3D内容上,确保帧与帧之间的高度一致性,避免了通用生成式AI可能出现的随机性和不可预测性问题。这让它能够在最高4K分辨率下实时运行,提供流畅且稳定的交互体验。

为了保护游戏的艺术风格多样性,英伟达为开发者提供了精细的控制权。开发者可以自由调节AI增强效果的强度、色彩,并通过遮罩(mask)来决定效果应用的具体区域。这意味着开发者只需构建基础的3D场景和艺术风格,而将提升真实感的繁重任务交给AI,既能达到惊艳的视觉效果,又不会让所有游戏都变成千篇一律的“AI画风”。同时,DLSS 5沿用了现有的NVIDIA Streamline集成框架,对于已经集成过DLSS的开发团队而言,接入成本和学习门槛都非常低。
目前,这项技术已经获得了Bethesda、CAPCOM、育碧、腾讯、网易等全球一线游戏厂商的支持,并将应用于《星空》《刺客信条:影》《生化危机:安魂曲》《逆水寒》《永劫无间》等众多国内外游戏大作中。DLSS 5的推出,不仅有望抹平实时渲染与预渲染CG之间的鸿沟,更可能重塑未来游戏的开发流程和玩家的视觉预期。