人工智能、大数据、数据挖掘、机器学习-数据集来源(中)

本文涉及的产品
云原生大数据计算服务 MaxCompute,5000CU*H 100GB 3个月
云原生大数据计算服务MaxCompute,500CU*H 100GB 3个月
简介: 人工智能、大数据、数据挖掘、机器学习-数据集来源(中)

Datamob.org


http://datamob.org/datasets


Factual


http://www.factual.com/topics/browse


Freebase


http://www.freebase.com/


Google


http://www.google.com/publicdata/directory


infochimps: http://www.infochimps.com/


numbray


http://numbrary.com/


Quora


https://www.quora.com/Data/Where-can-I-find-large-datasets-open-to-the-public


RS Collection 100+


http://rs.io/2014/05/29/list-of-data-sets.html


Sample R data sets


http://stat.ethz.ch/R-manual/R-patched/library/datasets/html/00Index.html


SourceForge 研究数据


http://www.nd.edu/ oss / 数据 / 研究司


StatSci.org


http://www.statsci.org/datasets.html


UFO 报告


http://www.nuforc.org/webreports.html


维基解密 911 寻呼机截取


http://911.wikileaks.org/files/index.html


Stats4Stem.org:R 数据集


http://www.stats4stem.org/data-sets.html


《华盛顿邮报》名单


http://www.washingtonpost.com/wp-srv/metro/data/datapost.html


科学


农业实验


http://www.insider.org/packages/cran/agridat/docs/agridat


气候数据


http://www.cru.uea.ac.uk/cru/data/temperature/#datter


and ftp://ftp.cmdl.noaa.gov/


Gene Expression Omnibus


http://www.ncbi.nlm.nih.gov/geo/


Geo Spatial Data


http://geodacenter.asu.edu/datalist/


Human Microbiome Project


http://www.hmpdacc.org/reference_genomes/reference_genomes.php


MIT Cancer Genomics Data


http://www.broadinstitute.org/cgibin/cancer/datasets.cgi


NASA


http://nssdc.gsfc.nasa.gov/nssdc/obtaining_data.html


NIH Microarray data


ftp://ftp.ncbi.nih.gov/pub/geo/DATA/supplementary/series/GSE6532/®


Protein structure


http://www.infobiotic.net/PSPbenchmarks/


Public Gene Data


http://www.pubgene.org/


斯坦福大学的微阵列数据


http://smd.stanford.edu/


社会科学


综合社会调查


http://www3.norc.org/GSS + 网站 /


ICPSR


http://www.icpsr.umich.edu/icpsrweb/ICPSR/access/index.jsp


皮尤研究


http://www.pewinternet.org/datasets/pages/2/


加州大学洛杉矶分校的社会科学档案


http://dataarchives.ss.ucla.edu/Home.DataPortals.html


UPJOHN 本月


http://www.upjohn.org/erdc/erdc.html


时间序列


时间序列数据库


http://robjhyndman.com/TSDL/


澳大利亚手语数据


http://kdd.ics.uci.edu/databases/auslan/auslan.html


高质量的澳大利亚手语数据


http://kdd.ics.uci.edu/databases/auslan2/auslan.html


脑电图数据


http://kdd.ics.uci.edu/databases/eeg/eeg.html


日本的元音


http://kdd.ics.uci.edu/databases/JapaneseVowels/JapaneseVowels.html


Pioneer-1 移动机器人数据


http://kdd.ics.uci.edu/databases/pioneer/pioneer.html


伪周期合成时间序列


http://kdd.ics.uci.edu/databases/synthetic/synthetic.html


合成控制图时间序列


http://kdd.ics.uci.edu/databases/synthetic_control/synthetic_control.html


大学


卡内基梅隆大学安然电子邮件


http://www.cs.cmu.edu/~ 安然 /


卡内基梅隆大学 StatLab


http://lib.stat.cmu.edu/datasets/


龙骨存储库


http://sci2s.ugr.es/keel/datasets.php


卡内基梅隆大学 JASA 数据归档


http://lib.stat.cmu.edu/jasadata/


俄亥俄州立大学财务数据


http://fisher.osu.edu/fin/osudata.htm


加州大学伯克利分校


http://ucdata.berkeley.edu/


加州大学洛杉矶分校


http://aws.amazon.com/datasets


加州大学河滨分校时间序列


http://www.cs.ucr.edu/ / time_series_data /


相关实践学习
基于MaxCompute的热门话题分析
本实验围绕社交用户发布的文章做了详尽的分析,通过分析能得到用户群体年龄分布,性别分布,地理位置分布,以及热门话题的热度。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps 
相关文章
|
1月前
|
机器学习/深度学习 人工智能 分布式计算
我的阿里云社区年度总结报告:Python、人工智能与大数据领域的探索之旅
我的阿里云社区年度总结报告:Python、人工智能与大数据领域的探索之旅
117 35
|
2月前
|
机器学习/深度学习 传感器 人工智能
人工智能与机器学习:改变未来的力量####
【10月更文挑战第21天】 在本文中,我们将深入探讨人工智能(AI)和机器学习(ML)的基本概念、发展历程及其在未来可能带来的革命性变化。通过分析当前最前沿的技术和应用案例,揭示AI和ML如何正在重塑各行各业,并展望它们在未来十年的潜在影响。 ####
110 27
|
2月前
|
机器学习/深度学习 数据采集 人工智能
深入探索人工智能与大数据的融合之路
本文旨在探讨人工智能(AI)与大数据技术如何相互促进,共同推动现代科技的进步。通过分析两者结合的必要性、挑战以及未来趋势,为读者提供一个全面的视角,理解这一领域内的最新发展动态及其对行业的影响。文章不仅回顾了历史背景,还展望了未来可能带来的变革,并提出了几点建议以促进更高效的技术整合。
|
2月前
|
机器学习/深度学习 人工智能 算法
人工智能浪潮下的编程实践:构建你的第一个机器学习模型
在人工智能的巨浪中,每个人都有机会成为弄潮儿。本文将带你一探究竟,从零基础开始,用最易懂的语言和步骤,教你如何构建属于自己的第一个机器学习模型。不需要复杂的数学公式,也不必担心编程难题,只需跟随我们的步伐,一起探索这个充满魔力的AI世界。
74 12
|
2月前
|
机器学习/深度学习 人工智能 算法
探索人工智能与机器学习的融合之路
在本文中,我们将探讨人工智能(AI)与机器学习(ML)之间的紧密联系以及它们如何共同推动技术革新。我们将深入分析这两种技术的基本概念、发展历程和当前的应用趋势,同时讨论它们面临的挑战和未来的发展方向。通过具体案例研究,我们旨在揭示AI与ML结合的强大潜力,以及这种结合如何为各行各业带来革命性的变化。
57 0
|
3月前
|
数据采集 机器学习/深度学习 人工智能
探索人工智能与大数据的融合之路####
本文将深入探讨人工智能(AI)与大数据之间的共生关系,揭示二者如何相互促进,共同推动技术边界的拓展。不同于传统摘要的概述形式,本部分将以一个生动的比喻开篇:如果把大数据比作广阔无垠的数字海洋,那么人工智能就是航行其间的智能航船,两者相辅相成,缺一不可。随后,简述文章将从数据采集、处理、分析到决策应用的全流程中,详细阐述AI如何借助大数据的力量实现自我迭代与优化,以及大数据如何在AI算法的驱动下释放出前所未有的价值。最后,预告文章还将探讨当前面临的挑战与未来趋势,为读者勾勒一幅AI与大数据融合发展的宏伟蓝图。 ####
|
3月前
|
机器学习/深度学习 算法 数据挖掘
K-means聚类算法是机器学习中常用的一种聚类方法,通过将数据集划分为K个簇来简化数据结构
K-means聚类算法是机器学习中常用的一种聚类方法,通过将数据集划分为K个簇来简化数据结构。本文介绍了K-means算法的基本原理,包括初始化、数据点分配与簇中心更新等步骤,以及如何在Python中实现该算法,最后讨论了其优缺点及应用场景。
193 6
|
3月前
|
机器学习/深度学习 数据采集 人工智能
人工智能与机器学习:解锁数据洞察力的钥匙
人工智能与机器学习:解锁数据洞察力的钥匙
|
3月前
|
机器学习/深度学习 人工智能 物联网
通义灵码在人工智能与机器学习领域的应用
通义灵码不仅在物联网领域表现出色,还在人工智能、机器学习、金融、医疗和教育等领域展现出广泛应用前景。本文探讨了其在这些领域的具体应用,如模型训练、风险评估、医疗影像诊断等,并总结了其提高开发效率、降低门槛、促进合作和推动创新的优势。
通义灵码在人工智能与机器学习领域的应用
|
3月前
|
机器学习/深度学习 人工智能 算法
探索人工智能与大数据的融合之道####
— 本文旨在探讨人工智能(AI)与大数据如何协同工作,以推动技术创新和产业升级。通过分析二者的基本概念、核心技术及应用场景,揭示它们相互促进的内在机制,并展望未来发展趋势。文章指出,AI提供了智能化处理数据的能力,而大数据则为AI提供了海量的训练资源,两者结合将开启无限可能。 ####