TensorRT优化方案图例
2021/12/14 6:16:49
本文主要是介绍TensorRT优化方案图例,对大家解决编程问题具有一定的参考价值,需要的程序猿们随着小编来一起学习吧!
TensorRT优化方案图例
图 12. TensorRT 循环由循环边界层设置。数据流只能通过下方式离开循环环输出层. 唯一允许的后边缘是第二个输入递归层。
图 13. 一个 if 条件构造抽象模型
图 14. 使用控制条件执行 IIf条件输入层 放置
图 15. 层执行和在 CPU 端启动的内核。
图 16. 内核实际运行在 GPU 上,换句话说,显示了 CPU 端的层执行和内核启动与在 GPU 端的执行之间的相关性。
图 17. 布局格式 CHW: 图像分为 高×宽矩阵,每个通道一个,矩阵按顺序存储;一个通道的所有值都是连续存储的。
图 18. 布局格式 HWC: 图像存储为单个 高×宽矩阵,值实际上是 C 元组,每个通道都有一个值;一个点(像素)的所有值都是连续存储的。
图 19. 一对通道值打包在一起 高×宽 矩阵。结果是一种格式,其中[C/2]高x宽 矩阵的值是两个连续通道的值对。
图 20. 在这个 NHWC8 格式,一个高×宽 矩阵包括所有通道的值。
图 21. 正常情况下的性能指标 trtexec在 Nsight Systems (ShuffleNet, BS=16, best, TitanRTX@1200MHz) 下运行。
参考链接:
https://docs.nvidia.com/deeplearning/tensorrt/developer-guide/index.html
这篇关于TensorRT优化方案图例的文章就介绍到这儿,希望我们推荐的文章对大家有所帮助,也希望大家多多支持为之网!
- 2024-11-23Springboot应用的多环境打包入门
- 2024-11-23Springboot应用的生产发布入门教程
- 2024-11-23Python编程入门指南
- 2024-11-23Java创业入门:从零开始的编程之旅
- 2024-11-23Java创业入门:新手必读的Java编程与创业指南
- 2024-11-23Java对接阿里云智能语音服务入门详解
- 2024-11-23Java对接阿里云智能语音服务入门教程
- 2024-11-23JAVA对接阿里云智能语音服务入门教程
- 2024-11-23Java副业入门:初学者的简单教程
- 2024-11-23JAVA副业入门:初学者的实战指南