c语言皮尔森系数程序,pearson coefficient (皮儿森相关系数)计算及R语言实现 zz

本文介绍了皮尔逊相关系数的概念,从高中数学和大学线性代数两个角度解释其原理,并通过具体的手算例子及R语言代码展示如何计算相关系数。同时,讨论了皮尔逊相关系数的约束条件,以及在实际统计中的应用。
摘要由CSDN通过智能技术生成

皮尔逊相关系数R语言例子

理解皮尔逊相关的两个角度

其一, 按照高中数学水平来理解, 皮尔逊相关(Pearson Correlation Coefficient)很简单,

可以看做将两组数据首先做Z分数处理之后,

然后两组数据的乘积和除以样本数

Z分数一般代表正态分布中, 数据偏离中心点的距离.等于变量减掉平均数再除以标准差.(就是高考的标准分类似的处理)

标准差则等于变量减掉平均数的平方和,再除以样本数,最后再开方.

所以, 根据这个最朴素的理解,我们可以将公式依次精简为:

a4c26d1e5885305701be709a3d33442f.png

其二, 按照大学的线性数学水平来理解, 它比较复杂一点,可以看做是两组数据的向量夹角的余弦. 台湾学者黄富廷在论文中进行了详细介绍.

皮尔逊相关的约束条件

从以上解释, 也可以理解皮尔逊相关的约束条件:

* 两个变量间有线性关系

* 变量是连续变量

* 变量均符合正态分布,且二元分布也符合正态分布

* 两变量独立

在实践统计中,一般只输出两个系数,一个是相关系数,也就是计算出来的相关系数大小,在-1到1之间;另一个是独立样本检验系数,用来检验样本一致性.

手算的例子

使用维基相关中的例子:

例如,假设五个国家的国民生产总值分别是1、2、3、5、8(单位10亿美元),又假设这五个国家的贫困比例分别是11%、12%、13%、15%、18%。

创建2个向量.(R语言)

x

y

按照维基的例子,应计算出相关系

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值