文章目录
一、引述
1.概念
- 典型相关分析用于研究两组变量(每组变量中都可能有多个指标)之间相关关系的一种多元统计方法。它能够揭示出两组变量之间的内在联系。
- 在一元统计分析中,用相关系数来衡量两个随机变量之间的线性相关关系;用复相关系数研究一个随机变量和多个随机变量的线性相关关系。然而,这些统计方法在研究两组变量之间的相关关系时却无能为力。比如要研究生理指标与训练指标的关系,居民生活环境与健康状况的关系,人口统计变量(户主年龄、家庭年收入、户主受教育程度)与消费变量(每年去餐馆就餐的频率、每年出外看电影的频率)之间是否具有相关关系 ?阅读能力变量(阅读速度、阅读才能)与数学运算能力变量(数学运算速度、数学运算才能)**是否相关?这些多变量间的相关性如何分析?
2.何为两组变量呢?
下图是测量的20名学生的生理指标与训练指标。第一组是生理指标变量,有体重、腰围和脉搏;第二组是训练指标变量,有引体向上次数、起坐次数和跳跃次数。要求测量生理指标与训练指标这两组变量之间的关系。
在本题中,如果我们直接对这些变量(诸如体重、胸围等变量)的相关性进行两两分析,很难得到题干所要求的测量生理指标与训练指标这两组变量之间的关系。所以,我们引入一种新的分析方法:典型相关分析。
3. 本文主要内容
- 本文主要目的在于介绍典型相关分析的基本思想和解题步骤以及讲解如何使用SPSS24.0解决该类数学建模问题。
- 如果要进行论文写作,我们需要掌握典型相关分析的原理及方法。这一部分,我将在后面的专栏中结合相关获奖论文进行说明。
二、典型相关分析
1. 基本思路
- 在上例中,我们可以采用这样的解决思路:由于两组变量中都含有多个变量指标,每组变量中定然会有代表性的变量。这样,找到代表性的变量,我们便可以把 多个变量与多个变量之间的相关变成两个具有代表性的变量之间的相关 。
- 代表性变量:能较为综合、全面的衡量所在组的内在规律。
- 一组变量最简单的综合形式就是该组变量的线性组合。
2. 基本思想
典型相关分析由Hotelling提出,其基本思想和主成分分析非常相似。
- 首先在每组变量中找出变量的线性组合,使得两组的线性组合之间具有最大的相关系数;
- 然后选取和最初挑选的这对线性组合不相关的线性组合,使其配对,并选取相关系数最大的一对。
- 如此继续下去,知道两组变量之间的相关性被提取完毕为止。
- 被选出的线性组合配对称为典型变量,它们的相关系数称为典型相关系数。典型相关系数度量了这两组变量之间的强度。
3. 基本思路
-
一般情况下,假设