开发者社区 问答 正文

python中连续数据离散化方法是什么呢?

python中连续数据离散化方法是什么呢?

展开
收起
游客qzzytmszf3zhq 2021-11-30 14:30:18 309 分享 版权
1 条回答
写回答
取消 提交回答
  • 等宽离散法:等距区间或自定义区间进行离散,有点是灵活,保持原有数据分布 等频离散法:根据数据的频率分布进行排序,然后按照频率进行离散,好处是数据变为均匀分布,但是会更改原有的数据结构 聚类离散法:使用k-means将样本进行离散处理 分位数法:使用四分位、五分位、十分位等进行离散 卡方:通过使用基于卡方的离散方法,找出数据的最佳临近区间并合并,形成较大的区间 二值化:数据跟阈值比较,大于阈值设置为某一固定值(例如1),小于设置为另一值(例如0),然后得到一个只拥有两个值域的二值化数据集。

    2021-11-30 14:30:33
    赞同 展开评论