C++ 实战之OpenCL环境搭建（一）

最新推荐文章于 2024-08-19 21:14:04 发布

哇小明

最新推荐文章于 2024-08-19 21:14:04 发布

阅读量1.1w

点赞数 3

分类专栏： OpenCL 文章标签： opencl 并行计算 android xcode mac

本文链接：https://blog.csdn.net/w401229755/article/details/78160066

版权

本文介绍了OpenCL的环境搭建，包括在Mac上使用Xcode进行开发，以及在Android手机上利用NDK和CMake进行OpenCL编程。通过简单的步骤展示了如何获取平台信息、创建上下文、编译源代码等，并提供了代码示例和GitHub链接。

摘要由CSDN通过智能技术生成

前言：

接触opencl并行计算变成之前，在我的认知观中，所谓的并行应该就是应用多线程技术达到，比如openMP，openMPI等多线程技术。不过这些都是在cpu上运行，原理都是更好的利用多核处理器的硬件特性，让程序最大程度的利用了多核的优势。

接触opencl之后，认识到了opencl编程技术可以把一些复杂的代码搬运到GPU或其他加速处理器上运行，而gpu又比cpu更适应与计算比如加法，乘法等。第一感觉想到的就是opengl里面的shader，编写shader不就是把渲染相关的代码放在gpu上运行吗？其实，普通的算法代码也可以放在gpu上运行，而opencl就是实现这一技术的标准。

学习路径

花了一两周时间对opencl进行了一个多方面粗略的了解，opencl更加接近于硬件，所以有很多硬件相关的概念，比如平台结构，内存模型等，还涉及到各种指令操作，对于一开始准备学习opencl的软件开发人员来说比较生涩难懂，所以前阶段会跳过对这些硬件相关的概念的钻研，重心转移到如何用opencl标准接口编程和opencl的编程模型，软件架构等。

应用场景：

OpenCL的一个最大的优势，就是他的跨平台性，首先不同的操作系统mac，windows，android；其次不同的cpu，gpu也都支持。我目前在mac上进行opencl的开发学习，支持的版本是opencl1.2.也会在手机上进行测试，不同的硬件厂商他们都会自己实现相应的opencl库，而头文件都是标准的。

Mac上应用：

编程的IDE是mac自带的xcode，mac系统里面已经集成了opencl的sdk所以不需要去另外去下载了，只要在工程中把它加进来就可以进行opencl开发了，很方便。
下面时mac环境搭建过程，比较简单，另外目前mac最高支持opencl1.2。
这里写图片描述

点击+按钮，开始选择opencl库，直接搜索opencl就会出现，如下：
这里写图片描述

添加之后，工程项目就会多一个opencl的framework ：

这里写图片描述
opencl开发有这几个标准的接口流程：

1.获取平台信息：
clGetPlatformIDs(1, &firstPlatformId, &numPlatforms);

2.创建上下文：
clCreateContextFromType(contextProperties, CL_DEVICE_TYPE_GPU,
NULL, NULL, &errNum);

3.获取设备缓冲区大小
clGetContextInfo(context, CL_CONTEXT_DEVICES, 0, NULL, &deviceBufferSize);

4.为设备分配缓存
clGetContextInfo(context, CL_CONTEXT_DEVICES, deviceBufferSize, devices, NULL);

5.选取可用的设备中的一个：
clCreateCommandQueue(context, devices[0], 0, NULL);

6.创建kernel对象和编译源代码
program = clCreateProgramWithSource(context, 1,
(const char**)&srcStr,
NULL, NULL);

errNum = clBuildProgram(program, 0, NULL, NULL, NULL, NULL);

7.最后释放opencl资源

下面是在mac上跑的例子：

//
//  main.cpp
//  OpenCL
//
//  Created by xxx on 2017/9/19.
//  Copyright © 2017年 xxx. All rights reserved.
//


#include <OpenCL/OpenCL.h>
#include <iostream>
#include <fstream>
#include <sstream>
#include <unistd.h>
#include <sys/time.h>
#include<time.h>
#include<stdio.h>
#include<stdlib.h>
#include <mach/mach_time.h>





const int ARRAY_SIZE = 100000;

//一、 选择OpenCL平台并创建一个上下文
cl_context CreateContext()
{
    cl_int errNum;
    cl_uint numPlatforms;
    cl_platform_id firstPlatformId;
    cl_context context = NULL;

    //选择可用的平台中的第一个
    errNum = clGetPlatformIDs(1, &firstPlatformId, &numPlatforms);
    if (errNum != CL_SUCCESS || numPlatforms <= 0)
    {
        std::cerr << "Failed to find any OpenCL platforms." << std::endl;
        return NULL;
    }

    //创建一个OpenCL上下文环境
    cl_context_properties contextProperties[] =
    {
        CL_CONTEXT_PLATFORM,
        (cl_context_properties)firstPlatformId,
        0
    };
    context = clCreateContextFromType(contextProperties, CL_DEVICE_TYPE_GPU,
                                      NULL, NULL, &errNum);

    return context;
}


//二、 创建设备并创建命令队列
cl_command_queue CreateCommandQueue(cl_context context, cl_device_id *device)
{
    cl_int errNum;
    cl_device_id *devices;
    cl_command_queue commandQueue = NULL;
    size_t deviceBufferSize = -1;

    // 获取设备缓冲区大小
    errNum = clGetContextInfo(context, CL_CONTEXT_DEVICES, 0, NULL, &deviceBufferSize);

    if (deviceBufferSize <= 0)
    {
        std::cerr << "No devices available.";
        return NULL;
    }

    // 为设备分配缓存空间
    devices = new cl_device_id[deviceBufferSize / sizeof(cl_device_id)];
    errNum = clGetContextInfo(context, CL_CONTEXT_DEVICES, deviceBufferSize, devices, NULL);

    //选取可用设备中的第一个
    commandQueue = clCreateCommandQueue(context, devices[0], 0, NULL);

    *device = devices[0];
    delete[] devices;
    return commandQueue;
}


// 三、创建和构建程序对象
cl_program CreateProgram(cl_context context, cl_device_id device, const char* fileName)
{
    cl_int errNum;
    cl_program program;

    std::ifstream kernelFile(fi