《异构信息网络挖掘: 原理和方法(1)》一导读

本文涉及的产品
数据管理 DMS,安全协同 3个实例 3个月
推荐场景:
学生管理系统数据库
简介: 当下大数据技术发展变化日新月异,大数据应用已经遍及工业和社会生活的方方面面,原有的数据管理理论体系与大数据产业应用之间的差距日益加大,而工业界对于大数据人才的需求却急剧增加。大数据专业人才的培养是新一轮科技较量的基础,高等院校承担着大数据人才培养的重任。


fb7533582f0d26408c7c39ba60045ecff8c41655

前 言

当下大数据技术发展变化日新月异,大数据应用已经遍及工业和社会生活的方方面面,原有的数据管理理论体系与大数据产业应用之间的差距日益加大,而工业界对于大数据人才的需求却急剧增加。大数据专业人才的培养是新一轮科技较量的基础,高等院校承担着大数据人才培养的重任。因此大数据相关课程将逐渐成为国内高校计算机相关专业的重要课程。但纵观大数据人才培养课程体系尚不尽如人意,多是已有课程的“冷拼盘”,顶多是加点“调料”,原材料没有新鲜感。现阶段无论多么新多么好的人才培养计划,都只能在20世纪六七十年代编写的计算机知识体系上施教,无法把当下大数据带给我们的新思维、新知识传导给学生。
为此我们意识到,缺少基础性工作和原始积累,就难以培养符合工业界需要的大数据复合型和交叉型人才。因此急需在思维和理念方面进行转变,为现有的课程和知识体系按大数据应用需求进行延展和补充,加入新的可以因材施教的知识模块。我们肩负着大数据时代知识更新的使命,每一位学者都有责任和义务去为此“增砖添瓦”。
在此背景下,我们策划和组织了这套大数据管理丛书,希望能够培养数据思维的理念,对原有数据管理知识体系进行完善和补充,面向新的技术热点,提出新的知识体系/知识点,拉近教材体系与大数据应用的距离,为受教者应对现代技术带来的大数据领域的新问题和挑战,扫除障碍。我们相信,假以时日,这些著作汇溪成河,必将对未来大数据人才培养起到“基石”的作用。
丛书定位:面向新形势下的大数据技术发展对人才培养提出的挑战,旨在为学术研究和人才培养提供可供参考的“基石”。虽然是一些不起眼的“砖头瓦块”,但可以为大数据人才培养积累可用的新模块(新素材),弥补原有知识体系与应用问题之前的鸿沟,力图为现有的数据管理知识查漏补缺,聚少成多,最终形成适应大数据技术发展和人才培养的知识体系和教材基础。
丛书特点:丛书借鉴Morgan & Claypool Publishers出版的Synthesis Lectures on Data Management,特色在于选题新颖,短小精湛。选题新颖即面向技术热点,弥补现有知识体系的漏洞和不足(或延伸或补充),内容涵盖大数据管理的理论、方法、技术等诸多方面。短小精湛则不求系统性和完备性,但每本书要自成知识体系,重在阐述基本问题和方法,并辅以例题说明,便于施教。
丛书组织:丛书采用国际学术出版通行的主编负责制,为此特邀中国人民大学孟小峰教授(email:xfmeng@ruc.edu.cn)担任丛书主编,负责丛书的整体规划和选题。责任编辑为机械工业出版社华章分社姚蕾编辑(email:yaolei@hzbook.com)。
当今数据洪流席卷全球,而中国正在努力从数据大国走向数据强国,大数据时代的知识更新和人才培养刻不容缓,虽然我们的力量有限,但聚少成多,积小致巨。因此,我们在设计本套丛书封面的时候,特意选择了清代苏州籍宫廷画家徐扬描绘苏州风物的巨幅长卷画作《姑苏繁华图》(原名《盛世滋生图》)作为底图以表达我们的美好愿景,每本书选取这幅巨卷的一部分,一步步见证和记录数据管理领域的学者在学术研究和工程应用中的探索和实践,最终形成适应大数据技术发展和人才培养的知识图谱,共同谱写出我们这个大数据时代的盛世华章。
在此期望有志于大数据人才培养并具有丰富理论和实践经验的学者和专业人员能够加入到这套书的编写工作中来,共同为中国大数据研究和人才培养贡献自己的智慧和力量,共筑属于我们自己的“时代记忆”。欢迎读者对我们的出版工作提出宝贵意见和建议。

目 录

第1章 引言
1.1 异构信息网络是什么
1.2 为什么异构网络挖掘是一项新的挑战
1.3 本书的内容组织
第一部分 基于排名的聚类和分类
第2章 基于排名的聚类
2.1 概述
2.2 RankClus算法
2.3 NetClus算法
第3章 异构信息网络的分类
3.1 概述
3.2 GNetMine
3.2.1 分类问题定义
3.2.2 基于图的正则化框架
3.3 RankClass
3.3.1 RankClass框架
3.3.2 基于图的排名
3.3.3 调整网络
3.3.4 后验概率计算
3.4 实验结果
3.4.1 数据集
3.4.2 准确性研究
3.4.3 案例研究
第二部分 基于元路径的相似性搜索和挖掘
第4章 基于元路径的相似性搜索
4.1 概述
4.2 PathSim:基于元路径的相似性度量
4.2.1 网络模式和元路径
4.2.2 基于元路径的相似性框架
4.2.3 PathSim:全新的相似性度量
4.3 单一元路径的在线查询处理
4.3.1 单一元路径的连接
4.3.2 基准算法
4.3.3 基于共同聚类的剪枝
4.4 多重元路径的组合
4.5 实验结果
4.5.1 有效性
4.5.2 效率对比
4.5.3 Flickr网络的案例研究

相关文章
|
12月前
|
SQL 数据建模 BI
数据治理的本质:体系化建模(2)
数据治理的本质:体系化建模
|
12月前
|
SQL
数据治理的本质:体系化建模(1)
数据治理的本质:体系化建模
118 0
|
数据采集 分布式计算 架构师
现代数据架构的核心特征:“1个中心+10个强化”
本文总结了现代数据架构的主要特征,并为正在开发新数据战略的组织提供参考。
现代数据架构的核心特征:“1个中心+10个强化”
|
算法 数据挖掘 大数据
《异构信息网络挖掘: 原理和方法》—— 导读
当下大数据技术发展变化日新月异,大数据应用已经遍及工业和社会生活的方方面面,原有的数据管理理论体系与大数据产业应用之间的差距日益加大,而工业界对于大数据人才的需求却急剧增加。大数据专业人才的培养是新一轮科技较量的基础,高等院校承担着大数据人才培养的重任。
2270 0
|
算法 数据挖掘 数据库
《异构信息网络挖掘: 原理和方法》—— 2.3 NetClus算法
我们解决的第二项聚类任务是针对包含更多类型的对象和链接、更一般性的异构信息网络,对各个类型对象实现软聚类。在异构信息网络中,具有星型网络模式的网络普遍存在且重要,例如以论文为中心的文献网络(例2.6),以带标签事件为中心的标签网络。
3599 0
|
算法 数据挖掘
《异构信息网络挖掘: 原理和方法》—— 2.2 RankClus算法
首先,我们来看看使用网络中其他类型对象(属性对象)和链接来对(目标)类型对象进行聚类的任务。例如,给定一个包含刊物和作者的双类型文献网络,其中刊物与作者之间,作者与作者之间都直接有链接。让我们感兴趣的是通过网络中的作者和链接,如何将刊物聚集为代表不同研究机构的若干聚类。
3928 0
《异构信息网络挖掘: 原理和方法》—— 1.1 异构信息网络是什么
信息网络是现实世界的抽象,关注于对象以及对象之间的交互。事实证明,这一层次的抽象既具有表达和存储现实世界本质信息的强大能力,同时通过运用链接的信息,为从现实世界挖掘知识提供了一个有用的工具。形式上,我们如下定义一个信息网络。
6987 0