开发者社区> 问答> 正文

python中的为什么要进行数据离散化呢?

python中的为什么要进行数据离散化呢?

展开
收起
游客qzzytmszf3zhq 2021-11-30 13:39:45 354 0
1 条回答
写回答
取消 提交回答
  • 算法需要 比如决策树、朴素贝叶斯等算法,都是基于离散型的数据展开的。如果要使用该类算法,必须将离散型的数据进行。有效的离散化能减小算法的时间和空间开销,提高系统对样本的分类聚类能力和抗噪声能力。

    离散化的特征相对于连续型特征更易理解,更接近知识层面的表达 比如工资收入,月薪2000和月薪20000,从连续型特征来看高低薪的差异还要通过数值层面才能理解,但将其转换为离散型数据(底薪、高薪),则可以更加直观的表达出了我们心中所想的高薪和底薪。

    可以有效的克服数据中隐藏的缺陷,使模型结果更加稳定

    2021-11-30 13:40:03
    赞同 展开评论 打赏
问答分类:
问答地址:
问答排行榜
最热
最新

相关电子书

更多
From Python Scikit-Learn to Sc 立即下载
Data Pre-Processing in Python: 立即下载
双剑合璧-Python和大数据计算平台的结合 立即下载