OpenBlas库----cblas_dgemm()函数

    在Caffe的源码中有很多地方使用OpenBlas库进行矩阵运算,今天就简单讲一下我在使用cblas_dgemm()函数的使用时遇到的问题。

    在网上查到的资料很多都是简单的说了下cblas_dgemm()函数的参数和功能,具体怎么用没有给出相应的代码,而且我对里面的转置也是很迷惑。先给大家几个博客地址:

官方例子:https://github.com/xianyi/OpenBLAS/wiki/User-Manual

很棒的以一个例子,我根据这个搞定的:http://blog.sina.com.cn/s/blog_4a03c0100101ethf.html

这个也不错:http://blog.csdn.net/g_spider/article/details/6054990

    在看下面的内容之前,请先仔细阅读函数参数。

    好了言归正传,讲讲几个大家不太熟悉的参数。

    第一个参数是选择行主序还是列主序。那什么是行主序?什么又是列主序呢?如下所示

    数组A[1,2,3,4,5,6,7,8,9]

    如果我们想将A按照行主序(CblasRowMajor)展开成一个3*3的矩阵结果如下:

    [1,2,3

     4,5,6

     7,8,9]

    如果我们想将A按照列主序(CblasRowMajor)展开成一个3*3的矩阵结果如下:

   [1,4,7

     2,5,8

     3,6,9]

    其实我们发现按照行主序就是按照行遍历矩阵得到数组A,按照列主序就是按照列遍历矩阵得到数组A。

    第二个参数:是不转置(CblasTrans  or  CblasNoTrans)

    开始对这个参数很迷惑,后来发现其实很简单,这个参数是和前面的参数(行或列主序)配合使用的。举例:如果你已经选择CblasRowMajor  如果CblasTrans被选择,那么对数组就按照列展开;如果选择CblasNoTrans被选择,那么对数组就按照行展开。简单的说就CblasRowMajor和CblasColMajor是个总开关,CblasTrans和CblasNoTrans是分开关。

好了,下面贴出代码再仔细讲讲。

<pre class="cpp" name="code">#include <openBLAS/cblas.h>
#include <stdio.h>
#include<iostream>
extern "C"

using namespace std;

void main()
{
	int i = 0;
	double A[6] = { 1.0, 2.0, 1.0, -3.0, 4.0, -1.0 };
	double B[6] = { 1.0, 2.0, 1.0, -3.0, 4.0, -1.0 };
	double C[9] = { .5, .5, .5, .5, .5, .5, .5, .5, .5 };
	double D[9] = { .5, .5, .5, .5, .5, .5, .5, .5, .5 };
	double E[9] = { .5, .5, .5, .5, .5, .5, .5, .5, .5 };
	double F[9] = { .5, .5, .5, .5, .5, .5, .5, .5, .5 };
	
	/*按列主序展开*/
	//1、都无转置
	cout << "按列主序展开,都无转置:" << endl;
	cblas_dgemm(CblasColMajor, CblasNoTrans, CblasNoTrans, 3, 3, 2, 1, A, 3, B, 2, 1, C, 3);
	for (i = 0; i<9; i++)
		printf("%lf ", C[i]);
	printf("\n");

	//2\矩阵B转置
	cout << "按列主序展开,矩阵B转置:" << endl;
	cblas_dgemm(CblasColMajor, CblasNoTrans, CblasTrans, 3, 3, 2, 1, A, 3, B, 3, 1, D, 3);
	for (i = 0; i<9; i++)
		printf("%lf ", D[i]);
	printf("\n");

	/*按行主序展开*/
	//1、都无转置
	cout << "按行主序展开,都无转置:" << endl;
	cblas_dgemm(CblasRowMajor, CblasNoTrans, CblasNoTrans, 3, 3, 2, 1, A, 2, B, 3, 1, E, 3);
	for (i = 0; i<9; i++)
		printf("%lf ",E[i]);
	printf("\n");

	//2、矩阵B转置
	cout << "按行主序展开,矩阵B转置:" << endl;
	cblas_dgemm(CblasRowMajor, CblasNoTrans, CblasTrans, 3, 3, 2, 1, A, 2, B, 2, 1, F, 3);
	for (i = 0; i<9; i++)
		printf("%lf ",F[i]);
	printf("\n");
}

 

结果:

 

下面我们来分析一下各种模式下数组A和B是怎样展开成矩阵的。

1、按列主序展开,都无转置

矩阵A=[1.0,-3.0                   矩阵B=[1.0,1.0,4.0                        A*B=[-5.0,10.0,7.0

            2.0,4.0                                 2.0,-3.0,-1.0]                              10.0,-10.0,4.0

            1.0,-1.0]                                                                                  -1.0,4.0,5.0]

结果矩阵C也是按列主序展开,(这个地方有点问题,一直没找到原因,大家注意)

2、按列主序展开,矩阵B转置

矩阵A=[1.0,-3.0                   矩阵B=[1.0,2.0,1.0                      A*B=[10.0,-10.0,4.0

            2.0,4.0                                 -3.0,4.0,-1.0]                              -10.0,20.0,-2.0

            1.0,-1.0]                                                                                  4.0,-2.0,2.0]

结果矩阵D按行主序展开

3、按行主序展开,都无转置

矩阵A=[1.0,2.0                  矩阵B=[1.0,2.0,1.0                        A*B=[-5.0,10.0,-1.0

            1.0,-3.0                              -3.0,4.0,-1.0]                              10.0,-10.0,4.0

             4.0,-1.0]                                                                                7.0,4.0,5.0]

结果矩阵E按行主序展开

4、按行主序展开,矩阵B转置

矩阵A=[1.0,2.0                  矩阵B=[1.0,1.0,4.0                         A*B=[5.0,-5.0,2.0

            1.0,-3.0                              2.0,-3.0,-1.0]                               -5.0,10.0,7.0

             4.0,-1.0]                                                                                 2.0,7.0,17.0]

结果矩阵F按行主序展开


注意:如果CblasColMajor 则lda,ldb,ldc是A,B,C的行

如果CblasRowMajor则lda,ldb,ldc是A,B,C的列


  • 7
    点赞
  • 11
    收藏
    觉得还不错? 一键收藏
  • 2
    评论
机器学习是一种人工智能(AI)的子领域,致力于研究如何利用数据和算法让计算机系统具备学习能力,从而能够自动地完成特定任务或者改进自身性能。机器学习的核心思想是让计算机系统通过学习数据中的模式和规律来实现目标,而不需要显式地编程。 机器学习应用非常广泛,包括但不限于以下领域: 图像识别和计算机视觉: 机器学习在图像识别、目标检测、人脸识别、图像分割等方面有着广泛的应用。例如,通过深度学习技术,可以训练神经网络来识别图像中的对象、人脸或者场景,用于智能监控、自动驾驶、医学影像分析等领域。 自然语言处理: 机器学习在自然语言处理领域有着重要的应用,包括文本分类、情感分析、机器翻译、语音识别等。例如,通过深度学习模型,可以训练神经网络来理解和生成自然语言,用于智能客服、智能助手、机器翻译等场景。 推荐系统: 推荐系统利用机器学习算法分析用户的行为和偏好,为用户推荐个性化的产品或服务。例如,电商网站可以利用机器学习算法分析用户的购买历史和浏览行为,向用户推荐感兴趣的商品。 预测和预测分析: 机器学习可以用于预测未来事件的发生概率或者趋势。例如,金融领域可以利用机器学习算法进行股票价格预测、信用评分、欺诈检测等。 医疗诊断和生物信息学: 机器学习在医疗诊断、药物研发、基因组学等领域有着重要的应用。例如,可以利用机器学习算法分析医学影像数据进行疾病诊断,或者利用机器学习算法分析基因数据进行疾病风险预测。 智能交通和物联网: 机器学习可以应用于智能交通系统、智能城市管理和物联网等领域。例如,可以利用机器学习算法分析交通数据优化交通流量,或者利用机器学习算法分析传感器数据监测设备状态。 以上仅是机器学习应用的一部分,随着机器学习技术的不断发展和应用场景的不断拓展,机器学习在各个领域都有着重要的应用价值,并且正在改变我们的生活和工作方式。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值