PCA笔记

简介: PCA笔记

参考:博客园-少年阿斌-机器学习降维-PCA

今天我学习了PCA(Principal Component Analysis),主成分分析方法。是一种使用最广泛的数据降维算法。

PCA:将n维特征映射到k维上,这k维是全新的正交特征(主成分)。

第一个新坐标轴选择是原始数据中方差最大的方向,第二个新坐标轴选取是与第一个坐标轴正交的平面中使得方差最大的,第三个轴是与第1,2个轴正交的平面中方差最大的。

可以得到n个这样的坐标轴。通过这种方式获得的新的坐标轴,大部分方差都包含在前面k个坐标轴中,后面的坐标轴所含的方差几乎为0。于是,可以忽略余下的坐标轴。

如何得到这些包含最大差异性的主成分方向。通过计算数据矩阵的协方差矩阵,然后得到协方差矩阵的特征值特征向量,选择特征值最大(即方差最大)的k个特征所对应的特征向量组成的矩阵。

由上面的公式,得到以下结论:

(1) 方差的计算公式是针对一维特征,即针对同一特征不同样本的取值来进行计算得到;而协方差则必须要求至少满足二维特征;方差是协方差的特殊情况。

(2) 方差和协方差的除数是n-1,这是为了得到方差和协方差的无偏估计。

协方差为正时,说明X和Y是正相关关系;协方差为负时,说明X和Y是负相关关系;协方差为0时,说明X和Y是相互独立。

推导PCA公式

坐标变换的目标是,找到一组新的正交单位向量,替换原来的正交单位向量。

……

参考:

https://zhuanlan.zhihu.com/p/35654077

https://zhuanlan.zhihu.com/p/55297233

相关文章
|
8月前
|
数据采集 机器学习/深度学习 搜索推荐
大模型开发: 描述主成分分析(PCA)以及它在降维中的应用。
PCA是广泛应用的降维技术,通过线性变换找到最大化方差的主成分,降低数据维度,简化计算并揭示数据结构。步骤包括数据预处理、计算协方差矩阵、特征值分解、选择主成分和数据转换。适用于图像识别、推荐系统等领域,但无监督性质可能导致类别信息丢失,且假设数据服从高斯分布。
142 1
|
8月前
|
数据采集 数据可视化 数据挖掘
使用R语言进行主成分分析(PCA)
【4月更文挑战第26天】本文介绍了如何使用R语言进行主成分分析(PCA),包括安装必要包`stats`、`FactoMineR`和`factoextra`,数据预处理如标准化,使用`PCA()`函数执行PCA,以及通过`summary()`、`fviz_pca_ind()`和`fviz_pca_var()`进行结果解读和可视化。此外,还讨论了如何通过载荷系数解释主成分,强调PCA在数据降维和探索数据结构中的作用。
364 1
|
8月前
|
算法 数据可视化 Python
使用Python实现主成分分析(PCA)
使用Python实现主成分分析(PCA)
279 4
|
数据采集 机器学习/深度学习 数据可视化
R实战| PCA、tSNE、UMAP三种降维方法在R中的实现
R实战| PCA、tSNE、UMAP三种降维方法在R中的实现
338 0
|
数据可视化 Linux
PCA分析基本知识和数学原理
PCA分析基本知识和数学原理
|
算法 数据挖掘 Python
python数据分析 - 数据降维PCA
python数据分析 - 数据降维PCA
128 0
|
机器学习/深度学习 数据可视化 算法
通俗易懂的讲解奇异值分解(SVD)和主成分分析(PCA)
通俗易懂的讲解奇异值分解(SVD)和主成分分析(PCA)
516 1
通俗易懂的讲解奇异值分解(SVD)和主成分分析(PCA)
|
机器学习/深度学习 算法 数据可视化
|
机器学习/深度学习 算法 搜索推荐
|
数据可视化
主成分分析(PCA)及其可视化的基础指南
主成分分析(PCA)及其可视化的基础指南
419 0
主成分分析(PCA)及其可视化的基础指南

热门文章

最新文章

下一篇
开通oss服务