5箱等宽离散法

连续数据离散化–5箱等宽离散法

今天又接触到一个新的概念—5箱等宽离散法。
在很多领域,都是基于离散的数据进行展开的,比如朴素贝叶斯算法。如果想利用这些方法,就必须将数据进行离散化。
离散化(分箱)常用的方法包括:等宽法、等频法以及聚类法。
等宽法就是使箱子的宽度相同,比如这篇博客里举的例子:

https://blog.youkuaiyun.com/abciscool/article/details/104984747

等频法就是让每个箱子的样本数量相等。假如一共有100个样本,要分成5个箱子,那个每个箱子的样本数量都是20。
聚类法首先将连续的数据利用聚类算法划分成簇,每个簇中的数据是一个箱子。

(侵权即删)

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值