大数据解决方案

本文涉及的产品
云原生大数据计算服务 MaxCompute,5000CU*H 100GB 3个月
云原生大数据计算服务MaxCompute,500CU*H 100GB 3个月
简介: 原文:大数据解决方案大数据处理 1、数据库 垂直拆分:根据业务把表放到不同的数据库,解决表之间的IO竞争 水平拆分:根据某种规则把单表数据分成多张表存储,解决单表数据量大的问题 索引:根据业务场景创建合理的索引,如果数据量很小建议使用索引(300条以内) 索引使用场景: 动作描...

大数据处理

1、数据库

垂直拆分:根据业务把表放到不同的数据库,解决表之间的IO竞争

水平拆分:根据某种规则把单表数据分成多张表存储,解决单表数据量大的问题

索引:根据业务场景创建合理的索引,如果数据量很小建议使用索引(300条以内)

索引使用场景:

动作描述

聚集索引

非聚集索引

主键列

外键列

列经常被分组排序

返回某范围内的数据

一个或极少不同值

小数目的不同值

大数目的不同值

频繁更新的列

频繁修改索引列

分离活跃数据:把常用的数据和不常用的数据分离,例如活跃用户和不活跃用户

读写分离:写用主库,读用从库

其它:表结构优化、SQL语句优化

2、缓存

     读数据时先从缓存中取,命中不到再读库

3、集群

     使用hadoop做集群,可以同时处理相同的数据

相关实践学习
基于MaxCompute的热门话题分析
本实验围绕社交用户发布的文章做了详尽的分析,通过分析能得到用户群体年龄分布,性别分布,地理位置分布,以及热门话题的热度。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps 
目录
相关文章
|
9月前
|
机器学习/深度学习 存储 分布式计算
大数据介绍
大数据介绍
94 2
|
传感器 人工智能 大数据
大数据
第二节 大数据 1.大数据的概念 麦肯锡公司对大数据的定义: 大数据是指大小超出常规的数据库工具获取、存储、管理和分析能力的数据集。 维基百科对大数据的定义: 大数据是指利用常用软件工具来获取、管理和处理数据所耗时间超过可容忍时间限制的数据集。这并不是一个精确的定义,因为无法确定常用软件工具的范围,可容忍时间也是个概略的描述。 2.大数据的特点 大数据具有5V特点(IBM提出),即: Volume(规模大)、Variety (种类多) 、Velocity (处理速度快)、Value (价值密度低)、Veracity (真实性) 2.大数据的特点 规模大: 数据规模大是大数据的基本属性。
|
存储 机器学习/深度学习 SQL
什么是大数据?
什么是大数据?
342 0
什么是大数据?
|
存储 分布式计算 资源调度
大数据1
大数据1
662 0
大数据1
|
人工智能 分布式计算 Oracle
大数据浅谈1
小弟不才,针对于大数据入门的一些小总结,希望能共同成长进步,大咖请绕路!!!
200 0
|
安全 大数据 定位技术
大数据之近古篇一
这是盛宣怀利用电报信息得到胡雪岩交易的大量数据,从而找出他的资金链漏洞,击败他的故事。
341 0
大数据之近古篇一
|
大数据 分布式计算 Hadoop
从0到1完全掌握大数据
经常听别人说“我要去学习大数据”,乍一听大数据应该是某个技术。而通俗来讲,大数据就是大到难以处理的数据集合,是社会技术发展过程中碰到的棘手问题。本文将从大数据的由来和相关技术分别展开进行讲解,从0到1系统地介绍如何学会使用大数据。
3445 0
|
新零售 存储 Java
关于大数据最常见的10个问题,必看!
1、云计算与大数据是什么关系?   云计算的关键词在于“整合”,无论你是通过现在已经很成熟的传统的虚拟机切分型技术,还是通过google后来所使用的海量节点聚合型技术,他都是通过将海量的服务器资源通过网络进行整合,调度分配给用户,从而解决用户因为存储计算资源不足所带来的问题。
1329 0