<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Cuda on 111qqz's blog</title><link>https://111qqz.com/en/tags/cuda/</link><description>Recent content in Cuda on 111qqz's blog</description><generator>Hugo -- gohugo.io</generator><language>en</language><copyright>© 2015-2026 111qqz</copyright><lastBuildDate>Tue, 24 Mar 2020 12:26:01 +0800</lastBuildDate><atom:link href="https://111qqz.com/en/tags/cuda/index.xml" rel="self" type="application/rss+xml"/><item><title>tensorRT 模型兼容性说明</title><link>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2020-03-24-tensorrt-model-compatibility-notes/</link><pubDate>Tue, 24 Mar 2020 12:26:01 +0800</pubDate><guid>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2020-03-24-tensorrt-model-compatibility-notes/</guid><description>&lt;h2 class="relative group"&gt;名词说明
 &lt;div id="名词说明" class="anchor"&gt;&lt;/div&gt;
 
 &lt;span
 class="absolute top-0 w-6 transition-opacity opacity-0 -start-6 not-prose group-hover:opacity-100 select-none"&gt;
 &lt;a class="text-primary-300 dark:text-neutral-700 !no-underline" href="#%e5%90%8d%e8%af%8d%e8%af%b4%e6%98%8e" aria-label="Anchor"&gt;#&lt;/a&gt;
 &lt;/span&gt;
 
&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;CUDA. 一般来说指的是CUDA SDK. 目前经常使用的是CUDA 8.0和CUDA 10.1两个版本. 8.0和10.1都是SDK的版本号.&lt;/li&gt;
&lt;li&gt;CUDNN. The NVIDIA CUDA® Deep Neural Network library (cuDNN). 是一个可以为神经网络提供GPU加速的库&lt;/li&gt;
&lt;li&gt;compute capability. 是GPU的固有参数,可以理解为GPU的版本.越新的显卡该数值往往越高.&lt;/li&gt;
&lt;li&gt;tensorRT.NVIDIA TensorRT™ is an SDK for high-performance deep learning inference. 是一个深度学习推理库,旨在提供高性能的推理速度.&lt;/li&gt;
&lt;li&gt;plan file,也称为 engine plan. 是生成的tensorRT 模型文件.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2 class="relative group"&gt;兼容性说明
 &lt;div id="兼容性说明" class="anchor"&gt;&lt;/div&gt;
 
 &lt;span
 class="absolute top-0 w-6 transition-opacity opacity-0 -start-6 not-prose group-hover:opacity-100 select-none"&gt;
 &lt;a class="text-primary-300 dark:text-neutral-700 !no-underline" href="#%e5%85%bc%e5%ae%b9%e6%80%a7%e8%af%b4%e6%98%8e" aria-label="Anchor"&gt;#&lt;/a&gt;
 &lt;/span&gt;
 
&lt;/h2&gt;
&lt;p&gt;&lt;strong&gt;Engine plan 的兼容性依赖于GPU的compute capability 和 TensorRT 版本, 不依赖于CUDA和CUDNN版本.&lt;/strong&gt;&lt;/p&gt;</description></item><item><title>CUDA C Best Practices Guide 阅读笔记（二） Heterogeneous Computing</title><link>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-13-cuda-c-best-practices-guide-heterogeneous-computing/</link><pubDate>Tue, 13 Feb 2018 06:38:38 +0000</pubDate><guid>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-13-cuda-c-best-practices-guide-heterogeneous-computing/</guid><description>&lt;p&gt;CUDA 编程涉及到在不同的平台上同时运行代码:包含CPU的host 和包含GPU的device.&lt;/p&gt;</description></item><item><title>CUDA C Best Practices Guide 阅读笔记（1） 并行计算方法论(APOD)</title><link>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-12-cuda-c-best-practices-parallel-computing-methodology/</link><pubDate>Mon, 12 Feb 2018 04:58:31 +0000</pubDate><guid>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-12-cuda-c-best-practices-parallel-computing-methodology/</guid><description>&lt;p&gt;APOD指的是Assess, Parallelize, Optimize, Deploy&lt;/p&gt;
&lt;figure&gt;&lt;img
 class="my-0 rounded-md"
 loading="lazy"
 decoding="async"
 fetchpriority="low"
 alt="Assess, Parallelize, Optimize, Deploy."
 src="http://docs.nvidia.com/cuda/cuda-c-best-practices-guide/graphics/apod-cycle.png"
 &gt;&lt;/figure&gt;
&lt;p&gt;如图所示，APOD过程是一个循环的过程，每次只进行一部分，从A到P到O到D,然后再进行下一轮的APOD&lt;/p&gt;</description></item><item><title>cuda c++ 基础算法库 thrust 学习笔记</title><link>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-10-cuda-thrust-notes/</link><pubDate>Sat, 10 Feb 2018 08:43:54 +0000</pubDate><guid>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-10-cuda-thrust-notes/</guid><description>&lt;p&gt;可以了解成并行版的STL(?&lt;/p&gt;
&lt;p&gt;过了一遍&lt;a href="http://docs.nvidia.com/cuda/thrust/index.html" target="_blank" rel="noreferrer"&gt;nvidia的官方网文档&lt;/a&gt;&lt;/p&gt;
&lt;p&gt;发现如果熟悉STL的话,thrust没什么太多好说的,看起来很简单&amp;hellip;&lt;/p&gt;</description></item><item><title>cuda error checking 学习笔记</title><link>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-09-cuda-error-checking-notes/</link><pubDate>Fri, 09 Feb 2018 06:55:00 +0000</pubDate><guid>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-09-cuda-error-checking-notes/</guid><description>&lt;p&gt;由于发现cuda c++ 的 debug方式和c++ 差别很大,因此打算再开一篇,专门记录一些和error checking 以及debug有关的内容.&lt;/p&gt;</description></item><item><title>cuda 学习笔记</title><link>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-01-cuda-notes/</link><pubDate>Thu, 01 Feb 2018 07:20:04 +0000</pubDate><guid>https://111qqz.com/en/post/%E5%B7%A5%E7%A8%8B/cuda/2018-02-01-cuda-notes/</guid><description>&lt;p&gt;uodate:有毒吧。kernel中出问题原来是不会报错的。。。。&lt;/p&gt;</description></item></channel></rss>