没有合适的资源?快使用搜索试试~ 我知道了~
首页OpenCL编程入门.pdf+可复制粘贴(非图片)
OpenCL编程入门.pdf+可复制粘贴(非图片) OpenCL 的文章网络上有很多,从入门到各种精通都有。本文的目的,是用尽量简洁的 叙述,建立对 OpenCL 相对全面的概念。本文适合刚开始接触异构计算和 OpenCL 的编程人 员,或想要了解 OpenCL 的人。 如果只是想知道如何写一个 Hello World,可以直接跳到:2.3 节。
资源详情
资源评论
资源推荐
OpenCL 编程入门
日期: 2014/11/6
1
OpenCL 编程入门
1. 概述
1.1 引言
OpenCL 的文章网络上有很多,从入门到各种精通都有。本文的目的,是用尽量简洁的
叙述,建立对 OpenCL 相对全面的概念。本文适合刚开始接触异构计算和 OpenCL 的编程人
员,或想要了解 OpenCL 的人。
如果只是想知道如何写一个 Hello World,可以直接跳到:2.3 节。
1.2 OpenCL 概念
OpenCL 是由 Khronos Group 针对异构计算设备(heterogeneous device)进行并行运算
所设计的标准 API 以及程式语言。
OpenCL 程序分成成两部分:一部分是在设备上执行的(例如 GPU),另一部分是在主
机上运行的。在设备上执行的程序就是实现“异构”和“并行计算”的部分。为了能在设备
上执行代码,程序员需要写一个特殊的函数(kernel 函数)。这个函数需要使用 OpenCL 语
言编写。OpenCL 语言采用了 C 语言的一部分加上一些约束、关键字和数据类型。在主机上
运行的程序用 OpenCL 的 API 管理设备上运行的程序。主机程序的 API 用 C 语言编写,也
有 C++、Java、Python 等高级语言接口。
2. OpenCL 使用和编程
2.1 OpenCL 的使用模型
网上找到下面这张图,比较简洁地说明了 OpenCL 的使用。
OpenCL 编程入门
2
从图中可以看出:
1. 异构计算设备,可以是 CPU 或 GPU。现在也有支持 OpenCL 的 FPGA 设备和至强
融核协处理设备(MIC)。
2. OpenCL 的 API 通过 Context(环境上下文)联系在一起。
3. 运行设备端的程序,经过了编译->设置参数->运行等步骤。
2.2 OpenCL 的一些基本概念
要理解 OpenCL 编程,首先需要理解一些基本概念。当然不喜欢阅读概念定义的同学可
以先跳过这一节,直接看编程的内容(2.3 节)。
Platform (平台):主机加上 OpenCL 框架管理下的若干设备构成了这个平台,通过这个
平台,应用程序可以与设备共享资源并在设备上执行 kernel。实际使用中基本上一个厂商对
应一个 Platform,比如 Intel, AMD 都是这样。
Device(设备):官方的解释是计算单元(Compute Units)的集合。举例来说,GPU 是
典型的 device。Intel 和 AMD 的多核 CPU 也提供 OpenCL 接口,所以也可以作为 Device。
Context(上下文):OpenCL 的 Platform 上共享和使用资源的环境,包括 kernel、device、
memory objects、command queue 等。使用中一般一个 Platform 对应一个 Context。
Program:OpenCL 程序,由 kernel 函数、其他函数和声明等组成。
Kernel(核函数):可以从主机端调用,运行在设备端的函数。
OpenCL 编程入门
3
Memory Object(内存对象):在主机和设备之间传递数据的对象,一般映射到 OpenCL
程序中的 global memory。有两种具体的类型:Buffer Object(缓存对象)和 Image Object(图
像对象)。
Command Queue(指令队列):在指定设备上管理多个指令(Command)。队列里指令
执行可以顺序也可以乱序。一个设备可以对应多个指令队列。
NDRange:主机端运行设备端 kernel 函数的主要接口。
注:Platform, Device 和 Context 的对应关系在实际使用中可以有所变化。理论上 Platform
与 Context 是 一 对 多 的 关 系 , Device 与 Context 可 以 是 多 对 多 的 关 系 。 如果用
clCreateContextFromType 创建 Context,可以忽略具体的 device id;如果用 clCreateContext
创建,可以忽略具体的 platform id。实际使用中一般只用一个 Device 对一个 Context。多种
对应组合的实验我没有做过,有经验的同学可以补充。
2.3 OpenCL 的编程步骤
OpenCL 主机端的编程比一般的 Hello World 要复杂一些,这里归纳为 12 个步骤。这个
过程不太需要变化,所以写过一次以后基本上只要复制就可以了。
剩余14页未读,继续阅读
泸州月
- 粉丝: 359
- 资源: 30
上传资源 快速赚钱
- 我的内容管理 收起
- 我的资源 快来上传第一个资源
- 我的收益 登录查看自己的收益
- 我的积分 登录查看自己的积分
- 我的C币 登录后查看C币余额
- 我的收藏
- 我的下载
- 下载帮助
会员权益专享
最新资源
- 27页智慧街道信息化建设综合解决方案.pptx
- 计算机二级Ms-Office选择题汇总.doc
- 单链表的插入和删除实验报告 (2).docx
- 单链表的插入和删除实验报告.pdf
- 物联网智能终端项目设备管理方案.pdf
- 如何打造品牌的模式.doc
- 样式控制与页面布局.pdf
- 武汉理工Java实验报告(二).docx
- 2021线上新品消费趋势报告.pdf
- 第3章 Matlab中的矩阵及其运算.docx
- 基于Web的人力资源管理系统的必要性和可行性.doc
- 基于一阶倒立摆的matlab仿真实验.doc
- 速运公司物流管理模式研究教材
- 大数据与管理.pptx
- 单片机课程设计之步进电机.doc
- 大数据与数据挖掘.pptx
资源上传下载、课程学习等过程中有任何疑问或建议,欢迎提出宝贵意见哦~我们会及时处理!
点击此处反馈
安全验证
文档复制为VIP权益,开通VIP直接复制
信息提交成功
评论1