开发者社区> 华章计算机> 正文
阿里云
为了无法计算的价值
打开APP
阿里云APP内打开

《R语言数据挖掘》——2.8 总结

简介:
+关注继续查看

本节书摘来自华章出版社《R语言数据挖掘》一书中的第2章,第2.8节,作者[哈萨克斯坦]贝特·麦克哈贝尔(Bater Makhabel),李洪成 许金炜 段力辉 译,更多章节内容可以访问云栖社区“华章计算机”公众号查看。

2.8 总结

本章主要学习了以下内容:

购物篮分析。

作为关联规则挖掘的第一步,频繁项集是一个主要因素。除算法设计外,定义了闭项集、最大频繁项集。

作为关联规则挖掘的目标,通过支持计数、置信度等度量来挖掘关联规则。除支持计数外,使用相关公式挖掘相关规则。

频繁项集的单调性,即,若某个项集是频繁的,则其所有子集也是频繁的。

Apriori算法是挖掘频繁模式的第一个高效算法,其他诸多算法均为Apriori的变体。

序列中的序列模式。

下一章将介绍基本分类算法,包括ID3、C4.5和CART等算法,这部分内容也是数据挖掘的重要应用。

版权声明:本文内容由阿里云实名注册用户自发贡献,版权归原作者所有,阿里云开发者社区不拥有其著作权,亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容,填写侵权投诉表单进行举报,一经查实,本社区将立刻删除涉嫌侵权内容。

相关文章
《数据科学:R语言实现》——导读
大数据、物联网、人工智能已经变成近几年最热门的科技流行语。尽管大家用很多名词去定义这些技术,但是共通的思想是它们都是数据驱动的。人们并不满足于简单地拥有数据,因为发现其中的价值才是最本质的。因此数据科学家已经开始关注如何从原始数据中洞悉深层价值。
1739 0
10057
文章
0
问答
来源圈子
更多
+ 订阅
文章排行榜
最热
最新
相关电子书
更多
低代码开发师(初级)实战教程
立即下载
阿里巴巴DevOps 最佳实践手册
立即下载
冬季实战营第三期:MySQL数据库进阶实战
立即下载