- 博客(2)
- 收藏
- 关注
原创 python实现卡方分箱Chi-Merge
卡方分箱是依赖于卡方检验的分箱方法,在统计指标上选择卡方统计量(chi-Square)进行判别,分箱的基本思想是判断相邻的两个区间是否有分布差异,基于卡方统计量的结果进行自下而上的合并,直到满足分箱的限制条件为止。卡方分箱的实现步骤:卡方统计量衡量了区间内样本的频数分布与整体样本的频数分布的差异性,在做分箱处理时可以使用两种限制条件:(1)分箱个数:限制最终的分箱个数结果,每次将样...
2018-05-29 14:25:25
29600
14
原创 python实现连续变量最优分箱--CART算法
关于变量分箱主要分为两大类:有监督型和无监督型对应的分箱方法:A. 无监督:(1) 等宽 (2) 等频 (3) 聚类B. 有监督:(1)卡方分箱法(ChiMerge) (2) ID3、C4.5、CART等单变量决策树算法 (3) 信用评分建模的IV最大化分箱 等本篇使用python,基于CART算法对连续变量进行最优分箱由于CART是决策树分类算法,所以相当于是单变量决策树...
2018-05-02 23:02:20
19835
6
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人