前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >CUDA入门

CUDA入门

作者头像
用户1154259
发布2018-01-17 18:10:41
6260
发布2018-01-17 18:10:41
举报

CUDA API包括三个,从低到高等级分别为 Thrust API  Runtime API   Driver API

用于CUDA的GPU是安装于主机系统中的独立设备

GPGPU运行在一个和主处理器相隔离的存储空间中

CUDA Kernel是可在主机代码中调用而在CUDA设备上运行的子程序(Kernel没有返回值)

Kernel的调用时异步的,即主机仅仅把要执行的Kernel顺序提交给GPGPU,并不等待执行完成,然后直接处理后面的其他任务

  cudaThreadSynchronize() 使主机进入阻塞状态

  cudaMemory() 实现阻塞式数据传输

GPU上的基本运行单位是线程

GPU上最大的可共享的内存区域成为全局内存

  常量内存、高速缓存、共享内存、局域内存、纹理内存、寄存器

GPGPU编程的三条法则

  1 将数据放入病始终存储于GPGPU

    pcie总线速度大概是8gb/s,而GPU全局内存的速度大概是160-200gb/s

  2 交给GPGPU足够多的任务

    传输数据还要消耗时间,因此,最好让GPU工作时间能补偿传输所浪费的资源

  3 注重GPGPU上的数据重用,以避免带宽限制

    尽量重用数据以获取高性能

回归测试:经常用一段代码作为回归测试,测试kernel函数的正确性

本文参与 腾讯云自媒体同步曝光计划,分享自作者个人站点/博客。
原始发表:2013-08-12 ,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档