尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

主成分分析结果解读:特征值、方差贡献率与载荷矩阵

主成分分析结果解读:特征值、方差贡献率与载荷矩阵 主成分分析结果解读一、方法概述主成分分析Principal Component Analysis, PCA是一种常用的降维技术其核心思想是通过正交变换将一组可能存在相关性的变量转化为一组线性不相关的综合指标主成分从而在尽可能保留原始信息的前提下实现数据维度的压缩。第一主成分解释最大的方差第二主成分在与第一主成分正交的约束下解释次大方差依此类推。该方法在综合评价、指标筛选、多指标体系简化等领域具有广泛应用。主成分分析的关键步骤包括适用性检验KMO和Bartlett检验、特征根提取与方差解释率计算、载荷矩阵解读、成分得分系数确定以及综合权重计算。SPSSAU软件提供了完整的主成分分析流程从前期适用性判断到最终综合得分计算可一站式完成降维分析和综合评价。在SPSSAU【进阶方法】模块选择【主成分】将变量拖拽至右侧对应分析框操作如下图二、适用性检验在进行主成分分析之前需要检验数据是否满足降维分析的前提条件。表1报告了KMO值和Bartlett球形检验结果。KMO值为0.810大于0.7的经验标准表明变量间存在较为充分的共享方差适合进行主成分分析。根据Kaiser提出的KMO解释标准0.9以上为极好0.8-0.9为好0.7-0.8为中等0.6-0.7为勉强可接受0.6以下为不适合。当前0.810属于好的水平。Bartlett球形检验的近似卡方值为1206.123df15, p0.001高度显著拒绝相关矩阵为单位阵的零假设说明6个变量之间确实存在显著的线性相关关系适合提取公共成分。两项检验结果共同支持了后续主成分分析的适用性。三、相关系数矩阵与MSA指标表2报告了6个变量之间的Pearson相关系数矩阵表3报告了各变量的MSAMeasure of Sampling Adequacy指标值。从相关系数矩阵来看x1、x2、x3三者之间呈高度相关r0.783-0.841x4、x5、x6三者之间也呈高度相关r0.740-0.816而两组之间的相关系数相对较低r0.354-0.416属于中等偏低水平。这种相关结构清晰地暗示了两个潜在的公共维度为后续提取两个主成分提供了直观依据。各变量的MSA值介于0.772x4至0.856x6之间均大于0.7说明每个变量与其他变量之间的偏相关关系较好均适合纳入主成分分析框架。整体MSA值为0.810与KMO值一致。四、特征根与方差解释率表4报告了各成分的特征根、方差解释率和累积方差解释率。按照特征根大于1的Kaiser准则提取了2个主成分。第一主成分的特征根为3.743解释了62.382%的总方差是贡献最大的成分。第二主成分的特征根为1.422解释了23.698%的方差。两个主成分的累积方差解释率为86.080%远超60%的经验标准说明提取两个主成分已经保留了原始6个变量中约86%的信息量信息损失仅为13.92%降维效果十分理想。从第三主成分开始特征根均远小于1最大仅0.292说明后续成分对总方差的贡献微乎其微。这一结果与相关系数矩阵中呈现的两组变量结构高度一致第一主成分主要捕获x1、x2、x3的共同方差第二主成分主要捕获x4、x5、x6的共同方差。五、载荷矩阵载荷矩阵是主成分分析结果解释的核心依据反映了各原始变量与主成分之间的相关程度。表5报告了各变量在两个主成分上的载荷系数及共同度。在主成分1上所有6个变量的载荷均为正值且较高范围从0.767x4至0.816x1。其中x10.816、x20.809和x50.793的载荷最高x30.786和x60.768次之x40.767略低。所有载荷均超过0.7的标准说明主成分1能够很好地代表各原始变量的信息。在主成分2上x1、x2、x3的载荷为负值-0.478、-0.470、-0.485而x4、x5、x6的载荷为正值0.534、0.479、0.472。这一载荷模式清晰地揭示了两个主成分的实际含义主成分1是一个综合维度反映了所有变量的共同变异总体水平主成分2则是一个对比维度将x1-x3第一组变量与x4-x6第二组变量区分开来体现了两组变量之间的相对差异。各变量的共同度介于0.812x6至0.894x1之间均远高于0.4的标准说明两个主成分对每个原始变量的解释效率都很高。x1的共同度最高0.894意味着两个主成分可解释x1约89.4%的方差x6的共同度相对最低0.812但仍有81.2%的方差被解释。六、线性组合系数与权重线性组合系数矩阵给出了如何由标准化后的原始变量计算各主成分得分的数学权重。表6报告了成分得分系数矩阵。在主成分1的得分计算中x1的系数最大0.422x2次之0.418各变量系数在0.396-0.422之间差异不大说明主成分1对6个变量赋予了较为均衡的权重。在主成分2的得分计算中x4的系数最大0.448x5次之0.402x1-x3的系数为负值-0.401至-0.407进一步印证了主成分2作为两组变量对比维度的特征。综合权重结果显示x4的权重最高22.97%x5次之22.81%x6为22.19%三者合计占总权重的67.97%。x1的权重为10.93%x2为10.89%x3为10.21%三者合计占32.03%。这一权重分布与主成分2的载荷模式密切相关由于x4-x6在两个主成分上的系数方向一致主成分1为正主成分2也为正其综合得分系数叠加后较大而x1-x3在主成分2上的系数为负与主成分1的正系数相互抵消导致综合得分系数相对较小。从综合评价的角度来看x4、x5、x6对最终综合得分的贡献约为x1、x2、x3的两倍。这一结果提示研究者在进行综合评价时应关注指标权重的非均衡性避免简单地将所有指标等权处理。七、样本缺失情况本次分析共纳入260个有效样本无缺失或剔除样本。对于6个变量的主成分分析260个样本量远超变量数的10倍标准60个样本量充足参数估计的稳定性较好。八、图形结果解读图1为主成分特征图碎石图以特征根大小为纵轴展示了各成分的方差贡献递减趋势。从图中可清晰观察到前两个成分的特征根远高于后续成分从第三个成分开始特征根急剧下降并趋于平缓形成明显的肘部效应。这一图形模式与Kaiser准则特征根1的提取结果高度一致直观支持了提取两个主成分的决策。图1 主成分特征图碎石图图2为主成分结构图以载荷图或双标图的形式展示了各变量在两个主成分构成的二维空间中的分布位置。从图中可观察到x1、x2、x3聚集在空间的一侧x4、x5、x6聚集在另一侧两组变量在二维空间中呈现明显的分离格局。这一可视化结果与载荷矩阵中主成分2的载荷模式完全吻合直观呈现了数据的双维结构特征。图2 主成分结构图九、结论本研究对6个变量进行了主成分分析KMO值为0.810Bartlett球形检验高度显著p0.001数据适合降维处理。按照特征根大于1的准则提取了2个主成分累积方差解释率为86.080%降维效果理想。载荷矩阵显示主成分1是所有变量的综合维度载荷0.767-0.816主成分2将x1-x3与x4-x6区分为两个对比维度。各变量共同度介于0.812至0.894之间信息保留充分。综合权重分析表明x422.97%、x522.81%和x622.19%对综合得分的贡献最大合计占总权重的67.97%。260个有效样本量充足分析结果稳定可靠。
返回列表