快科技 7 月 22 日消息,NVIDIA 在 SIGGRAPH 2026 大会上长达一小时的演讲中,用了整整 22 分钟详细展示了 DLSS 5 的技术细节,系统性地回应了有关 DLSS 5 争议,重点展示了开发者对 AI 渲染画面的全面控制能力。
在今年春季,DLSS 5 公布后引发了不小的争议,玩家和工作室担心这项技术会像一个 AI 美颜滤镜一样,改变精心设计的画面和氛围。应用深度学习研究总监 Edward Liu 在演讲中没有直接提及这场风波,但 22 分钟的演示毫无疑问以消除这些争议为核心目标。
Liu 将 DLSS 5 面临的核心挑战定义为在看起来更真实和忠于原始内容之间取得平衡,他强调,"Creator Intent"(创作者意图)在任何时候都不应被破坏。DLSS 5 以引擎渲染的原始画面为基础,逐像素对应的就是创作者意图本身。
Liu 指出,给十个生成式 AI 模型同一张图片作为输入,会得到十个不同的结果,DLSS 5 面临的挑战更大,因为所有调整都必须在实时进行:玩家看到的画面就是 DLSS 5 输出的画面,必须做到精准无误。
为此,NVIDIA 在训练模型时将 " 尊重创作者意图 " 置于最高优先级,模型需要理解哪些元素必须保留,Liu 举例称,角色脸上的疤痕不会消失,但会看起来更真实。
DLSS 5 需要锁定的关键元素
NVIDIA 在演讲中展示了 DLSS 5 需要锁定保留的关键元素,包括角色身份、对象语义、姿态、光照语义、运动和艺术方向。这些维度构成了创作者意图的骨架,AI 模型在增强画面时不得越界。
为实现实时 4K 推理,NVIDIA 采用了小型紧凑的单步扩散模型,在保证画面质量的同时将延迟控制在可接受范围内。这也是 DLSS 5 能够在游戏帧率下运行的关键技术基础。
NVIDIA 还重点展示了开发者对 DLSS 5 的全面控制能力,正如今年 3 月 GTC 上预告的那样,开发者可以为自己的游戏定制 DLSS 5 的行为。
首先是 AI 模型选择。开发者可以在三款不同的 AI 模型(A、B、C)之间选择,每款模型的训练数据不同,画面风格也有差异。这一选择不必全局生效,可以按场景切换,让开发者在不同环境下使用最合适的模型。
三款 AI 模型(A/B/C)在 80% 结构强度下的效果对比
其次是全局强度控制,开发者可以逐场景调节两个滑块:
结构强度主要影响光照、阴影和表面纹理的表现,色调强度则控制色彩和亮度的调整幅度。两者作用于整幅画面,也可以完全关闭。
对于角色画面,DLSS 5 提供了独立的控制维度,系统能够自动检测画面中的人物(自动遮罩),开发者可以单独设定 AI 模型对角色外观的干预程度,也可以选择仅对角色应用 DLSS 5 效果。
更灵活的是开发者自定义遮罩功能,开发者可以为特定物体或物体组创建遮罩,精确控制 DLSS 5 的作用范围和强度,也可以将某些物体完全排除在 AI 处理之外。
例如,开发者可以让整个场景保持引擎渲染的原貌,仅对天空进行 AI 增强,这种对象级的控制粒度在之前的 DLSS 版本中是不存在的。
NVIDIA 强调,SIGGRAPH 2026 上展示的设置只是开始,后续还会有更多控制选项加入。不过这些功能是否会在 DLSS 5 于 2026 年秋季正式上线时全部可用,NVIDIA 并未明确。
【本文结束】如需转载请务必注明出处:快科技
责任编辑:黑白


登录后才可以发布评论哦
打开小程序可以发布评论哦