人工智能、大数据、数据挖掘、机器学习-数据集来源(中)

本文涉及的产品
云原生大数据计算服务 MaxCompute,5000CU*H 100GB 3个月
云原生大数据计算服务MaxCompute,500CU*H 100GB 3个月
简介: 人工智能、大数据、数据挖掘、机器学习-数据集来源(中)

Datamob.org


http://datamob.org/datasets


Factual


http://www.factual.com/topics/browse


Freebase


http://www.freebase.com/


Google


http://www.google.com/publicdata/directory


infochimps: http://www.infochimps.com/


numbray


http://numbrary.com/


Quora


https://www.quora.com/Data/Where-can-I-find-large-datasets-open-to-the-public


RS Collection 100+


http://rs.io/2014/05/29/list-of-data-sets.html


Sample R data sets


http://stat.ethz.ch/R-manual/R-patched/library/datasets/html/00Index.html


SourceForge 研究数据


http://www.nd.edu/ oss / 数据 / 研究司


StatSci.org


http://www.statsci.org/datasets.html


UFO 报告


http://www.nuforc.org/webreports.html


维基解密 911 寻呼机截取


http://911.wikileaks.org/files/index.html


Stats4Stem.org:R 数据集


http://www.stats4stem.org/data-sets.html


《华盛顿邮报》名单


http://www.washingtonpost.com/wp-srv/metro/data/datapost.html


科学


农业实验


http://www.insider.org/packages/cran/agridat/docs/agridat


气候数据


http://www.cru.uea.ac.uk/cru/data/temperature/#datter


and ftp://ftp.cmdl.noaa.gov/


Gene Expression Omnibus


http://www.ncbi.nlm.nih.gov/geo/


Geo Spatial Data


http://geodacenter.asu.edu/datalist/


Human Microbiome Project


http://www.hmpdacc.org/reference_genomes/reference_genomes.php


MIT Cancer Genomics Data


http://www.broadinstitute.org/cgibin/cancer/datasets.cgi


NASA


http://nssdc.gsfc.nasa.gov/nssdc/obtaining_data.html


NIH Microarray data


ftp://ftp.ncbi.nih.gov/pub/geo/DATA/supplementary/series/GSE6532/®


Protein structure


http://www.infobiotic.net/PSPbenchmarks/


Public Gene Data


http://www.pubgene.org/


斯坦福大学的微阵列数据


http://smd.stanford.edu/


社会科学


综合社会调查


http://www3.norc.org/GSS + 网站 /


ICPSR


http://www.icpsr.umich.edu/icpsrweb/ICPSR/access/index.jsp


皮尤研究


http://www.pewinternet.org/datasets/pages/2/


加州大学洛杉矶分校的社会科学档案


http://dataarchives.ss.ucla.edu/Home.DataPortals.html


UPJOHN 本月


http://www.upjohn.org/erdc/erdc.html


时间序列


时间序列数据库


http://robjhyndman.com/TSDL/


澳大利亚手语数据


http://kdd.ics.uci.edu/databases/auslan/auslan.html


高质量的澳大利亚手语数据


http://kdd.ics.uci.edu/databases/auslan2/auslan.html


脑电图数据


http://kdd.ics.uci.edu/databases/eeg/eeg.html


日本的元音


http://kdd.ics.uci.edu/databases/JapaneseVowels/JapaneseVowels.html


Pioneer-1 移动机器人数据


http://kdd.ics.uci.edu/databases/pioneer/pioneer.html


伪周期合成时间序列


http://kdd.ics.uci.edu/databases/synthetic/synthetic.html


合成控制图时间序列


http://kdd.ics.uci.edu/databases/synthetic_control/synthetic_control.html


大学


卡内基梅隆大学安然电子邮件


http://www.cs.cmu.edu/~ 安然 /


卡内基梅隆大学 StatLab


http://lib.stat.cmu.edu/datasets/


龙骨存储库


http://sci2s.ugr.es/keel/datasets.php


卡内基梅隆大学 JASA 数据归档


http://lib.stat.cmu.edu/jasadata/


俄亥俄州立大学财务数据


http://fisher.osu.edu/fin/osudata.htm


加州大学伯克利分校


http://ucdata.berkeley.edu/


加州大学洛杉矶分校


http://aws.amazon.com/datasets


加州大学河滨分校时间序列


http://www.cs.ucr.edu/ / time_series_data /


相关实践学习
基于MaxCompute的热门话题分析
本实验围绕社交用户发布的文章做了详尽的分析,通过分析能得到用户群体年龄分布,性别分布,地理位置分布,以及热门话题的热度。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps 
相关文章
|
2月前
|
机器学习/深度学习 人工智能 物联网
通义灵码在人工智能与机器学习领域的应用
通义灵码不仅在物联网领域表现出色,还在人工智能、机器学习、金融、医疗和教育等领域展现出广泛应用前景。本文探讨了其在这些领域的具体应用,如模型训练、风险评估、医疗影像诊断等,并总结了其提高开发效率、降低门槛、促进合作和推动创新的优势。
通义灵码在人工智能与机器学习领域的应用
|
2月前
|
机器学习/深度学习 算法 数据挖掘
K-means聚类算法是机器学习中常用的一种聚类方法,通过将数据集划分为K个簇来简化数据结构
K-means聚类算法是机器学习中常用的一种聚类方法,通过将数据集划分为K个簇来简化数据结构。本文介绍了K-means算法的基本原理,包括初始化、数据点分配与簇中心更新等步骤,以及如何在Python中实现该算法,最后讨论了其优缺点及应用场景。
116 4
|
3月前
|
机器学习/深度学习 人工智能 自然语言处理
人工智能与机器学习:探索未来的技术边界
【10月更文挑战第18天】 在这篇文章中,我们将深入探讨人工智能(AI)和机器学习(ML)的基础知识、应用领域以及未来趋势。通过对比分析,我们将揭示这些技术如何改变我们的生活和工作方式,并预测它们在未来可能带来的影响。文章旨在为读者提供一个全面而深入的理解,帮助他们更好地把握这一领域的发展趋势。
|
17天前
|
机器学习/深度学习 传感器 人工智能
人工智能与机器学习:改变未来的力量####
【10月更文挑战第21天】 在本文中,我们将深入探讨人工智能(AI)和机器学习(ML)的基本概念、发展历程及其在未来可能带来的革命性变化。通过分析当前最前沿的技术和应用案例,揭示AI和ML如何正在重塑各行各业,并展望它们在未来十年的潜在影响。 ####
82 27
|
12天前
|
机器学习/深度学习 数据可视化 大数据
机器学习与大数据分析的结合:智能决策的新引擎
机器学习与大数据分析的结合:智能决策的新引擎
97 15
|
30天前
|
机器学习/深度学习 人工智能 算法
人工智能浪潮下的编程实践:构建你的第一个机器学习模型
在人工智能的巨浪中,每个人都有机会成为弄潮儿。本文将带你一探究竟,从零基础开始,用最易懂的语言和步骤,教你如何构建属于自己的第一个机器学习模型。不需要复杂的数学公式,也不必担心编程难题,只需跟随我们的步伐,一起探索这个充满魔力的AI世界。
48 12
|
2月前
|
机器学习/深度学习 分布式计算 算法
【大数据分析&机器学习】分布式机器学习
本文主要介绍分布式机器学习基础知识,并介绍主流的分布式机器学习框架,结合实例介绍一些机器学习算法。
236 5
|
2月前
|
机器学习/深度学习 人工智能 算法
人工智能与机器学习的融合之旅
【10月更文挑战第37天】本文将探讨AI和机器学习如何相互交织,共同推动技术发展的边界。我们将深入分析这两个概念,了解它们是如何互相影响,以及这种融合如何塑造我们的未来。文章不仅会揭示AI和机器学习之间的联系,还会通过实际案例展示它们如何协同工作,以解决现实世界的问题。
|
2月前
|
机器学习/深度学习 人工智能 算法
【手写数字识别】Python+深度学习+机器学习+人工智能+TensorFlow+算法模型
手写数字识别系统,使用Python作为主要开发语言,基于深度学习TensorFlow框架,搭建卷积神经网络算法。并通过对数据集进行训练,最后得到一个识别精度较高的模型。并基于Flask框架,开发网页端操作平台,实现用户上传一张图片识别其名称。
105 0
【手写数字识别】Python+深度学习+机器学习+人工智能+TensorFlow+算法模型
|
2月前
|
机器学习/深度学习 算法 PyTorch
用Python实现简单机器学习模型:以鸢尾花数据集为例
用Python实现简单机器学习模型:以鸢尾花数据集为例
143 1