讲讲PCA主成分分析

最新推荐文章于 2024-06-19 21:50:07 发布

原创

最新推荐文章于 2024-06-19 21:50:07 发布 · 2.6k 阅读

·

1

·

CC 4.0 BY-SA版权

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

文章标签：

#算法 #人工智能 #数据挖掘 #数据分析 #机器学习

在机器学习的领域中，我们对原始数据进行特征提取，经常会得到高维度的特征向量。在这些多特征的高维空间中，会包含一些冗余和噪声。所以我们希望通过降维的方式来寻找数据内部的特性，提升特征表达能力，降低模型的训练成本。PCA是一种降维的经典算法，属于线性、非监督、全局的降维方法。

01

PCA原理

PCA的原理是线性映射，简单的说就是将高维空间数据投影到低维空间上，然后将数据包含信息量大的主成分保留下来，忽略掉对数据描述不重要的次要信息。而对于正交属性空间中的样本，如何用一个超平面对所有样本进行恰当合适的表达呢？若存在这样的超平面，应该具有两种性质：

所有样本点到超平面的距离最近
样本点在这个超平面的投影尽可能分开

以上两种性质便是主成分分析的两种等价的推导，即PCA最小平方误差理论和PCA最大方差理论，本篇主要为大家介绍最大方差理论。

PCA的降维操作是选取数据离散程度最大的方向(方差最大的方向)作为第一主成分，第二主成分选择方差次大的方向，并且与第一个主成分正交。不算重复这个过程直到找到k个主成分。

最低0.47元/天解锁文章

评论

成就一亿技术人!

拼手气红包6.0元

还能输入1000个字符

添加红包

插入表情

表情包

代码片

HTML/XML
objective-c
Ruby
PHP
C
C++
JavaScript
Python
Java
CSS
SQL
其它

条评论被折叠查看

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。