灵巧小蝴蝶

文章
4
资源
0
加入时间
3年0月8天

机器学习处理数据为什么把连续性特征离散化,离散化有何好处?

作者:自信回头来源:知乎原文链接:机器学习处理数据为什么把连续性特征离散化,离散化有何好处?在机器学习中,很多人在处理数据的时候,经常把连续性特征离散化。为此挺好奇,为什么要这么做,什么情况下才要做呢。 一、离散化原因 数据离散化是指将连续的数据进行分段,使其变为一段段离散化的区间。分段的原则有基于等距离、等频率或优化的方法。数据离散化的原因主要有以下几点: 1、算法需要 比如决策树、朴素贝叶斯等算法,都是基于离散型的数据展开的。如果要使用该类算法,必须将离散型的数据进行。有效的离散化能