特征工程---特征预处理

小玩偶啊

于 2022-03-13 16:28:58 发布

阅读量1.1k

点赞数

CC 4.0 BY-SA版权

分类专栏：机器学习 python 文章标签： sklearn 机器学习 python

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.youkuaiyun.com/qq_39759664/article/details/123459848

1. 什么是特征预处理

1.1 特征预处理定义

通过⼀些转换函数将特征数据转换成更加适合算法模型的特征数据过程
在这里插入图片描述

为什么我们要进⾏归⼀化/标准化？
特征的单位或者⼤⼩相差较⼤，或者某特征的⽅差相⽐其他的特征要⼤出⼏个数量级，容易影响（⽀配）⽬标结果，使得⼀些算法⽆法学习到其它的特征

1.2 包含内容(数值型数据的⽆量纲化)

归⼀化
标准化

1.3 特征预处理API

sklearn.preprocessing

2 归⼀化

2.1 定义

通过对原始数据进⾏变换把数据映射到(默认为[0,1])之间

2.2 公式

在这里插入图片描述

作⽤于每⼀列，max为⼀列的最⼤值，min为⼀列的最⼩值,那么X’’为最终结果，mx，mi分别为指定区间值默认 mx为1,mi为0

2.3 API

sklearn.preprocessing.MinMaxScaler (feature_range=(0,1)… )

MinMaxScalar.fit_transform(X)
------X:numpy array格式的数据[n_samples,n_features]
返回值：转换后的形状相同的array

2.4 数据计算

我们对以下数据进⾏运算，在dating.txt中。保存的就是之前的约会对象数据

milage,Liters,Consumtime,target
40920,8.326976,0.953952,3
14488,7.153469,1.673904,2
26052,1.441871,0.805124,1
75136,13.147394,0.428964,1
38344,1.669788,0.134296,1

1、实例化MinMaxScalar
2、通过fit_tra

最低0.47元/天解锁文章

200万优质内容无限畅学

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。