Visual Enhancer 是一款适用于 Windows 系统的便携式应用程序,它利用 NVIDIA RTX 显卡上的 AI 技术来增强图片和视频的效果。该软件通过 Neuroframe 引擎运用 NVIDIA DLSS 5 神经渲染技术来处理图片和视频;同时,还利用 NVIDIA DLSS 帧生成技术来插值处理视频帧。此外,NVIDIA RTX 视频超分辨率和 RTX 视频 HDR 功能则可用于实现高质量的图像提升效果。在播放过程中,该软件还能将 DLSS 5 神经渲染技术应用到本地视频以及支持的在线流媒体内容上。
DLSS 5 神经网络渲染技术
Neuroframe 引擎:能够将 DLSS 5 神经渲染技术直接应用于视觉增强功能中,处理图片和视频。无需任何外部图形处理工具或游戏插件。
图像和视频处理:通过预览功能、针对每个文件的处理进度显示以及诊断报告,来优化单个文件或整批文件的处理效果。
神经网络渲染控制选项包括:神经网络风格、神经网络强度、局部色调强度、局部结构强度、皮肤结构强度、自动遮罩功能,以及 1 到 4 次神经网络渲染处理。
合成控制选项包括:NR 颜色强度、色调保持、面部/皮肤保护、纹理保持以及遮罩过渡效果。这些选项可以让用户更精确地控制神经渲染效果与原始图像的融合方式。
仅保留细节:这是一键预设功能,能够保留原始图像的色彩和色调,同时保留神经网络渲染带来的细节变化。
自定义神经渲染遮罩:利用图像遮罩来控制神经渲染的适用范围。所选的遮罩在当前应用会话期间也始终有效。
闪烁抑制功能:有助于在视频和实时处理过程中,保持各帧之间的细节清晰度。
处理比例:可按原始尺寸的 125%、150%、175%、200%、75%、50%或 25%来进行处理。这一功能与 RTX 视频超分辨率功能是分开的。
HDR 格式保留:支持的相关视频处理流程能够以 H.265、AV1 或 ProRes Proxy 格式来保留 10 位 HDR 格式的内容。
RTX 视频超分辨率处理功能
NVIDIA RTX 视频超分辨率技术:能够以 1 至 4 级不同的质量标准,对图像或 SDR 视频进行增强和分辨率提升处理。
灵活的尺寸设置:可以选择 1 倍原始分辨率、1.5 倍、2 倍、3 倍、4 倍的放大比例,或者自定义输出尺寸,每维度的最大尺寸可达 16384 像素。
NVIDIA RTX 视频 HDR 功能:可将 SDR 视频转换为 HDR 格式,同时可调节对比度、饱和度、中间灰度值、峰值亮度以及处理精度。
混合处理:RTX 视频超分辨率技术和 RTX 视频 HDR 功能可以一起使用,或者单独使用 RTX 视频 HDR 功能。
图像输出格式包括 PNG、JPEG、WebP、AVIF 和 TIFF。用户可以自行控制图像的质量、元数据以及文件命名方式。
视频输出格式:H.264、H.265、AV1 和 ProRes Proxy。在支持 NVIDIA NVENC 的硬件上,还可以使用该格式进行输出。
DLSS 帧生成技术
帧插值:利用 NVIDIA DLSS 帧生成技术来生成额外的帧数,从而实现更流畅的视频播放效果和更高的帧率。
目标帧率:可从 23.976 帧/秒到 480 帧/秒之间进行选择,涵盖了常见的电影、广播以及高刷新率应用场景。
DLSSG 模式:自动模式、原生 DLSSG 模式和级联模式,能够根据不同的源帧率和目标帧率,灵活地进行插值处理。
预览片段:在开始完整渲染之前,可以预览当前播放位置之前的 3 秒、5 秒、10 秒、20 秒或 30 秒的内容。
HDR 格式保留:支持 H.265、AV1 和 ProRes Proxy 格式的 10 位 HDR 输出。
直播中
本地播放和在线播放:在观看本地视频、直接网络流媒体、YouTube 及 Twitch 上的内容时,均可应用 DLSS 5 神经网络渲染技术。
集成播放功能:无需离开直播界面,即可暂停或继续播放、调节音量、静音、全屏显示等。
直播质量控制:可选择视频源的质量、最大输入分辨率(从 480p 到 2160p 不等),还可以设置 1/2/4 秒的片段长度、自动/源视频/60/30/24 帧每秒的播放模式。此外,还具备 2 到 30 秒的播放缓冲区。
独立实时调整:Live 拥有独立的神经渲染设置,因此 Live 所做的调整不会覆盖主神经渲染的设置。自定义的神经渲染遮罩在当前会话中仍然保持共享状态。
动态更新:在直播进行过程中,大多数与神经渲染相关的设置都可以进行更改。对于源文件、比例、质量、帧率、分割方式以及缓冲区的更改,都会在下次直播开始时生效。
性能信息:在直播进行时,可以查看处理和播放的进度情况。
工作流程与预览
统一媒体查看器:可以比较“输入”和“输出”视图的效果,也可以选择“分割”、“双屏显示”或“仅输出”等查看模式。此外,还能将图像调整到适合查看器的尺寸,以 100%的比例查看图像内容,同时还可以在共享的时间轴上浏览视频。
实时预览:支持神经网络渲染技术;分辨率调整后,当前预览画面会自动更新。视频预览会跟随所选的播放头位置进行显示。
批量处理:可以添加多个文件或文件夹,通过拖放方式上传媒体文件,重新处理那些处理失败的文件,删除已处理完成的文件,停止处理过程。此外,还可以在资源管理器中查看已处理完成的文件。
剪贴板图片:可直接将支持的图片内容粘贴到图片处理流程中。
每个文件的处理进度:每个队列项都会显示其当前状态、处理进度、已用时间、处理详情、文件尺寸以及输出路径。
GPU 选择:用于人工智能处理的 GPU 应与用于 NVIDIA NVENC 视频编码的 GPU 分开来选择。
自动容器格式:H.264 使用 MP4 格式,H.265 和 AV1 则使用 MKV 格式,而 ProRes Proxy 则使用 MOV 格式。
安全的输出处理机制:已完成的文件会被保留下来,未完成的工作会在必要时被清除。同时,现有的文件不会被擅自覆盖。
媒体保存:在可能的情况下,所支持的工作流程会保留各种有用的源信息,比如视频的旋转角度、时间戳、元数据、章节信息、音频及字幕等内容。
处理完成的媒体文件会被保存到 outputs/ 中。日志和诊断报告则保存在 logs/ 中,可供故障排除时使用。
支持的媒体类型
类型 输入 输出结果
图片/图像 常见的图像格式:HEIF/HEIC、SVG、TIFF,以及多种相机 RAW 格式。 PNG、JPEG、WebP、AVIF、TIFF
视频 MP4、MKV、MOV、AVI、WebM、M4V、TS/MTS/M2TS、MXF、VOB、WMV、FLV、MPG/MPEG 等所有受支持的视频格式 H.264、H.265、AV1、ProRes Proxy
直播中 本地视频、直接网络直播、YouTube、Twitch 在视觉增强器中进行了处理后的回放。
在图像处理过程中,系统会利用 EXIF 信息来确定图像的旋转方向;同时会处理各种受支持的色彩配置文件。只要有可能,系统会保留图像中的元数据。此外,图像的透明度也会被保留下来,除非是将图像保存为 JPEG 格式。对于动画或多页图像,系统会使用第一帧或第一页的内容来进行处理。
要求/条件
Windows 系统:支持 Direct3D 12 技术的 64 位 Windows 11 操作系统。
NVIDIA RTX 显卡:需为兼容 NVIDIA GeForce RTX 系列的显卡,并且需安装了最新的 NVIDIA 驱动程序。
DLSS 5 神经网络渲染功能:该功能的可用性取决于所使用的 NVIDIA RTX 硬件、已安装的驱动程序,以及所选 AI 处理 GPU 上该功能的初始化是否成功。
DLSS 帧生成功能:需要兼容的 NVIDIA RTX 硬件。同时,必须启用硬件加速的 GPU 调度功能(HAGS)。
RTX 视频功能:RTX 视频超分辨率和 RTX 视频 HDR 功能需要兼容的 NVIDIA RTX 硬件以及相应的驱动程序支持。
NVIDIA NVENC:使用 NVIDIA NVENC 进行输出时,所选的编解码器和输出设置必须具备硬件编码功能。当然,也可以选择使用 CPU 进行编码。
背景设定
DLSS 5 神经渲染
背景设定 价值观 默认
NR 风格 默认、自然、电影风格 默认值
规模/程度 原始比例:125%、150%、175%、200%、75%、50%、25% 来源/原文
NR 强度 0.00–2.00 1.00
NR 通行证 1–4 1
本地音调强度 0.00–2.00 1.00
局部结构强度 0.00–2.00 1.00
皮肤结构强度 -1.00–2.00 -1.00
NR 颜色强度 0.00–1.00 1.00
音调保持不变 0.00–1.00 0.00
面部/皮肤保护 0.00–1.00 0.00
谷物保存 0.00–1.00 0.00
面具羽毛 0–128 个输出像素 0
自动面罩 关,开 关掉
抑制闪光 0.00–1.00;仅视频和直播 0.70
“NR Passes”参数用于控制要应用的神经渲染次数。增加渲染次数会提升处理效率,同时也能获得更出色的渲染效果。
“比例”参数用于控制神经渲染所使用的尺寸。保持“原始尺寸”选项时,图像会保持其原有的尺寸;选择“百分比”选项时,图像会按照所指定的比例进行缩放。神经渲染的尺寸必须符合要求:最小为 64×64,最大为 7680×4320。此设置与 RTX 视频超分辨率功能是相互独立的。
“仅细节”模式将“神经网络颜色强度”设置为 0.00 ,将“色调保持”设置为 1.00 。所有其他与神经网络渲染相关的设置仍可进行编辑。
将“皮肤结构强度”设置为高于 -1.00 的值后,系统会自动启用“自动遮罩”功能,从而使皮肤调整效果能够生效。不过,之后仍然可以手动关闭“自动遮罩”功能。
高端版:图片处理效果
设置 选择与行为 默认值
VSR 质量 1 - 低,2 - 中,3 - 高,4 - 超高 4 - 超级版
输出规模/输出量 比例因子或自定义尺寸 比例因子
比例因子 1 倍、1.5 倍、2 倍、3 倍、4 倍 2×
自定义维度 每个维度上最多可达到 16384 像素;数值不能小于原始数据的数值。 3840×2160
锁定宽高比 关闭,开启 在……那天/于……日期
输出格式 PNG、JPEG、WebP、AVIF、TIFF PNG
图像质量 有损格式的压缩比范围为 1–100 95
保留 EXIF 元数据 关闭,开启 在……那天/于……日期
重命名 自动、复制、自定义 自动
RTX 视频超分辨率功能可以在 1 倍分辨率下使用,从而在不放大图像尺寸的情况下提升图像质量。在最终渲染之前,还可以预览所选图像的效果。
高端版:视频版
设置 选择与行为 默认值
RTX 视频超分辨率技术 关闭,开启 在……那天/于……日期
VSR 质量 1 - 低,2 - 中,3 - 高,4 - 超高 4 - 超级版
输出规模/输出量 比例因子或自定义尺寸 比例因子
比例因子 1 倍、1.5 倍、2 倍、3 倍、4 倍 2×
自定义维度 每个维度上最多可达到 16384 像素;当启用 VSR 功能时,分辨率不能低于原始图像的分辨率。 3840×2160
锁定宽高比 关闭,开启 在……那天/于……日期
RTX 视频 HDR 功能 关闭/开启;可将 SDR 格式的输入信号转换为 HDR 格式。 关闭/停止
HDR 对比度 0–200 100
HDR 饱和度 0–200 100
HDR 中间灰度值 10–100 50
HDR 峰值亮度 400–2000 尼特 1000 尼特
HDR 处理精度 10 位压缩格式,10 位压缩格式(FP16) 采用 10 位编码方式
视频编解码器 H.264、H.265、AV1、ProRes Proxy 格式;如可用的话,还支持 CPU/NVIDIA NVENC 编码方式。 H.265(NVIDIA NVENC)
集装箱 从编解码器中自动选定 MKV
编码质量 自动(默认)、良好、最佳、最大 自动(默认)
重命名 自动、复制、自定义 自动
RTX 视频超分辨率功能和 RTX 视频 HDR 功能可以同时使用。如果只想使用 HDR 功能,也可以关闭视频超分辨率功能,但必须至少启用一个 RTX 视频效果。
RTX Video HDR 能够接收 SDR 格式的输入视频,并将其转换为 HDR 格式的输出。该功能不支持 HDR 格式的输入视频。若要获得 HDR 格式的输出,必须使用 H.265、AV1 或 ProRes Proxy 编码格式。
帧插值
设置 选择与行为 默认值
输出帧率 23.976, 25, 29.97, 30, 50, 59.94, 60, 90, 119.88, 120, 144, 165, 180, 240, 360, 480 60
DLSS 引擎 自动模式、原生 DLSSG 模式、级联模式 自动
预览时长 3 秒、5 秒、10 秒、20 秒、30 秒 3 秒
视频编解码器 H.264、H.265、AV1、ProRes Proxy 格式;如可用的话,还支持 CPU/NVIDIA NVENC 编码方式。 H.264 编码格式(NVIDIA NVENC 编码器)
集装箱 从编解码器中自动选定 MP4
编码质量 自动(默认)、良好、最佳、最大 自动(默认)
保留 10 位 HDR 格式 关闭/开启;仅支持 H.265/AV1/ProRes 格式。 关闭/停止
重命名 自动、复制、自定义 自动
系统会自动为所请求的源帧率和输出帧率选择合适的 DLSS 帧生成方式。如果所选的输出帧率等于或低于源帧率,系统会直接对帧进行重采样,而不会生成额外的帧。
直播中
设置 选择与行为 默认值
来源 在线网址或本地视频 在线状态
来源质量 自动模式、480p、720p、1080p、1440p、2160p 自动
最大输入分辨率 480p、720p、1080p、1440p、2160p 720p
片段时长 1 秒、2 秒、4 秒 2 秒
目标帧率 自动、源、60、30、24 自动
回放缓冲区 2–30 秒 6 秒
神经网络渲染控制机制 神经渲染控制的独立实时版本 神经网络渲染的默认设置
在播放过程中,大多数与实时神经渲染相关的设置都可以进行更改。那些已被缓冲的帧会保持其先前的样式,直到播放到新处理的帧为止。缩放比例、视频源、视频源质量、最大输入分辨率、各段的持续时间、目标帧率以及播放缓冲区的相关设置,都将在下一次开始实时渲染时生效。
视频输出与编码
输出设置 行为/举止
H.264 MP4 格式;支持 CPU 或 NVIDIA NVENC 编码方式;8 位单色图像格式
H.265 MKV 格式;支持 CPU 或 NVIDIA NVENC 编码方式;兼容 10 位 HDR 显示模式。
AV1 MKV 格式;支持 CPU 或 NVIDIA NVENC 编码方式;兼容 10 位 HDR 显示模式。
ProRes Proxy 格式 MOV;基于 CPU 的 10 位 4:2:2 格式输出;支持 HDR 模式
编码质量 自动(默认)、良好、最佳、最大
重命名 “自动”模式会生成与工作流程相关的名称;“复制”模式则保留源文件的原始名称;“自定义”模式则会在名称后添加所选的后缀。
在支持的情况下,兼容的工作流程会保留元数据和章节信息。MKV 格式能够保留兼容的音频和字幕流,而 MP4/MOV 格式则使用 AAC 音频格式。如果所选的工作流程允许,那么文本字幕也会被保留下来。
申请/提交
设置 选择与行为 默认值
AI 处理用 GPU 自动模式(最佳性能)或兼容的 NVIDIA RTX 显卡 自动的/无需人工操作的
视频处理专用 GPU 用于 NVIDIA NVENC/NVDEC 功能的自动检测到的 NVIDIA GPU。 自动的/无需人工操作的
预览编码策略 自动模式,始终使用 H.264 编码格式,该功能已禁用。 自动
实时预览 关闭/开启;神经网络渲染与图像放大技术 在……那天/于……日期
全尺寸高质量预览 关闭/开启;在支持的情况下,保持全分辨率的图像预览效果。 在……那天/于……日期
预设设置 以 JSON 格式导出或导入可调整的应用程序设置 无/不适用
所保存的 GPU 选择会保持与所选 GPU 的对应关系。如果该 GPU 不再可用,设置会自动恢复为“自动”模式。此外,兼容的旧版设置预设也可以被自动导入和迁移。