质量提升了,都是性能换的
ati吧
全部回复
仅看楼主
level 13
看国外懂哥说FSR使用FP16计算,因为计算成本的关系仅在运动矢量方面使用了AI推理,别的部分都没有
不用矩阵加速指令就是带着镣铐跳舞,但是用了又会杀死兼容性,两难选择
来源:https://gpuopen.com/manuals/fidelityfx_sdk/fidelityfx_sdk-page_techniques_super-resolution-upscaler/
2024年07月19日 13点07分 1
level 12
通用算法怎么改都是拆东墙补西墙了。
2024年07月19日 13点07分 2
level 13
OK不用懂哥说,这个使用说明里面写的很清楚
恢复为 32 位浮点数
FSR 旨在利用半精度 (FP16) 硬件加速来实现最高性能。然而,为了为应用程序提供最高级别的兼容性和灵活性,FSR 还具有使用全精度 (FP32) 操作编译着色器的功能。
建议在所有支持 FSR 的硬件上使用 FP16 版本。您可以通过查询D3D12_FEATURE_DATA_SHADER_MIN_PRECISION_SUPPORTDirectX(R)12 中的功能来查询显卡对 FP16 的支持级别 - 您应该检查是否D3D[11/12]_SHADER_MIN_PRECISION_16_BIT设置了,如果没有,则回退到 FP32 版本的 FSR。对于 Vulkan,如果VkPhysicalDeviceFloat16Int8FeaturesKHR::shaderFloat16没有设置,那么您应该回退到 FP32 版本的 FSR。同样,如果VkPhysicalDevice16BitStorageFeatures::storageBuffer16BitAccess没有设置,您也应该回退到 FP32 版本的 FSR。
要在 FSR 着色器源代码中启用 FP32 路径,您应该将其定义FFX_HALF为1。为了在 FP16 和 FP32 之间共享算法的大部分源代码(确保高水平的代码共享以支持持续的维护),您会注意到 FSR 着色器源代码使用了一组类型宏,这些宏有助于在着色器源中轻松切换 16 位和 32 位基类型。
2024年07月19日 13点07分 3
1