MaxCompute(原ODPS)开发入门指南——计量计费篇

本文涉及的产品
云原生大数据计算服务 MaxCompute,5000CU*H 100GB 3个月
云原生大数据计算服务MaxCompute,500CU*H 100GB 3个月
简介: 近期介绍大量数据上云用户关于MaxCompute的一些问题,现就MaxCompute产品线的一些工具栈可以和大家进行交流,也欢迎大家拍砖和来扰,一起学习一起进步!也希望能够在帮助到大家!

MaxCompute(原ODPS)开发入门指南

写在最前面

>>>进入了解更多>>>阿里云数加·MaxCompute大数据计算服务.

近期介绍大量数据上云用户关于MaxCompute的一些问题,现就MaxCompute产品线的一些工具栈可以和大家进行交流,也欢迎大家拍砖和来扰,一起学习一起进步!也希望能够在帮助到大家!

SQL Cost

系列文章会涉及到的内容

  • 0.MaxCompute概述:是什么?可以做什么?收费模式?
  • 1.数据上云工具介绍:Log、Logstash、Flume、Fluentd、DataX等
  • 2.MaxCompute开发工具:Data IDE和MaxCompute Studio
  • 3.数据分析展现工具概述:Quick BI

MaxCompute概述

MaxCompute(原ODPS)是一项大数据计算服务,它能提供快速、完全托管的PB级数据仓库解决方案,使您可以经济并高效的分析处理海量数据。

MaxCompute是什么

MaxCompute 是面向大数据处理的云计算服务,主要提供结构化和非结构化数据的存储和计算服务,
是阿里巴巴云计算整体解决方案中最核心的主力产品之一。

在分析海量数据场景下,由于单台服务器的处理能力限制,数据分析者通常采用分布式计算模式。但分布式的计算模型对数据分析人员提出了较高的要求,且不易维护。使用分布式模型,数据分析人员不仅需要了解业务需求,同时还需要熟悉底层计算模型。MaxCompute 的目的是为用户提供一种便捷的分析处理海量数据的手段。用户可以不必关心分布式计算细节,从而达到分析大数据的目的。

MaxCompute 已经在阿里巴巴集团内部得到大规模应用,例如:大型互联网企业的数据仓库和 BI 分析、网站的日志分析、电子商务网站的交易分析、用户特征和兴趣挖掘等。

进入https://www.aliyun.com/solution/customer选择大数据,了解更多MaxCompute用户案例。

MaxCompute可以做什么

从产品设计角度,MaxCompute 主要面向三类大数据处理场景:基于SQL 构建大规模数据仓库和企业BI 系统,基于MapReduce 和BSP 的分布式编程模型开发大数据应用,基于统计和机器学习算法开发大数据统计模型和数据挖掘。在后面“典型场景”一节将会给出这些场景的应用实例。

从服务角度,MaxCompute 采用抽象的作业处理框架将不同场景的各种计算任务统一在同一个平台之上,共享安全、存储、数据管理和资源调度,为来自不同用户需求的各种数据处理任务提供统一的编程接口和界面。MaxCompute 这种集成多种不同大数据处理应用场景的设计思想领先于业界同类云计算产品,为大数据应用开发提供一个非常强大的平台。

MaxCompute怎么收费?

关于MaxCompute的收费问题也是大家近期最为关心的话题,下面为大家一一解答。更多关于计量计费说明

目前,MaxCompute以项目project为计费单元,对project内的数据存储、计算(目前只是SQL)、数据下载(走公网收费)进行收费,计费周期都是当天出前一天的账单。

SQL Cost

数据存储-收费

  • 0< 存储量 < 512MB: 收取当前项目0.01元费用。
  • 存储量 > 512MB:
基础价格 大于100GB部分 大于1TB部分 大于10TB部分 大于100TB部分 1PB以上部分
0.0192元/GB/天 0.0096元/GB/天 0.0084元/GB/天 0.0072元/GB/天 0.006元/GB/天 请通过工单联系我们

例如用户某个项目的存储为50TB,则每天收取的费用为:

 100GB*0.0192元/GB/天  --基础价格
 +(1024-100)GB*0.0096元/GB/天   --大于100GB部分价格
 +(10240-1024)GB*0.0084元/GB/天  --大于1TB部分价格
 +(50*1024-10240)GB*0.0072元/GB/天  --大于10TB部分价格
 =383.12元/天

由于MaxCompute会对原始数据进行压缩,那么计费依据也是按照压缩后的数据量进行计算,一般压缩比在5倍左右。

计算计费(后付费/预付费)

  • 后付费:以作业实际消耗量作为统计指标,在执行后进行收费。

所谓按I/O后付费是指:用户每执行一条SQL作业,MaxCompute将根据该作业的输入数据及该SQL的复杂度进行计费。

一次SQL计算费用 = 计算输入数据量(SQL语句实际扫描数据量) SQL复杂度 SQL价格(0.3元/GB),其中复杂度一般先统计SQL语句中的关键字再进行折算,也可以使用cost sql 进行估算。

SQL关键字个数 = Join个数 + Group By个数 + Order By个数 + Distinct个数 + 窗口函数个数 + max(insert into个数-1, 1)

在Data IDE中会针对每个SQL在执行前会进行一次计算消费的预估,如下图:

SQL Cost

  • 预付费:包年包月购买CU方式,10CU起售。

1CU = 1CPU + 4GB内存,售价为 150元/月。

下载计费

对于公网或者跨Region的数据下载,MaxCompute将按照下载的数据大小进行计费(也就是说数据下载走内网模式且在当前region内是不计费的)。计费公式为:

一次下载费用 = 下载数据量 * 下载价格

针对不同网络环境(访问 MaxCompute 及其 Tunnel 服务的连接地址)的收费模式详细说明如下:

区域 网络 MaxCompute服务连接 MaxCompute tunnel连接 下载是否收费
华东1 公网 http://service.odps.aliyun.com/api http://dt.odps.aliyun.com
华东1 经典网络 http://odps-ext.aliyun-inc.com/api http://dt-ext.odps.aliyun-inc.com
华东1 VPC http://odps-ext.aliyun-inc.com/api http://dt-ext.odps.aliyun-inc.com
华东2 公网 http://service.odps.aliyun.com/api http://dt.odps.aliyun.com
华东2 经典网络 http://odps-ext.aliyun-inc.com/api http://dt.eu13.odps.aliyun.com
华东2 VPC http://odps-ext.aliyun-inc.com/api http://dt-ext.eu13.odps.aliyun-inc.com
华北2 公网 http://service.odps.aliyun.com/api http://dt.odps.aliyun.com
华北2 经典网络 http://odps-ext.aliyun-inc.com/api http://dt-ext.nu16.odps.aliyun-inc.com
华北2 VPC http://odps-ext.aliyun-inc.com/api http://dt-ext.nu16.odps.aliyun-inc.com
其他 公网 http://service.odps.aliyun.com/api http://dt.odps.aliyun.com
其他 经典网络 http://odps-ext.aliyun-inc.com/api http://dt-ext.odps.aliyun-inc.com
其他 VPC 不支持,需要用户走公网访问 不支持,需要用户走公网访问 --
  • 如上述还不能帮助到大家,大家可以进入计量计费详细说明进行了解。也可以通过如下钉钉扫码方式进入,咨询我们的售前工程师。

SQL Cost

相关实践学习
基于MaxCompute的热门话题分析
本实验围绕社交用户发布的文章做了详尽的分析,通过分析能得到用户群体年龄分布,性别分布,地理位置分布,以及热门话题的热度。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps&nbsp;
目录
相关文章
|
1月前
|
SQL 分布式计算 DataWorks
DataWorks产品使用合集之如何开发ODPS Spark任务
DataWorks作为一站式的数据开发与治理平台,提供了从数据采集、清洗、开发、调度、服务化、质量监控到安全管理的全套解决方案,帮助企业构建高效、规范、安全的大数据处理体系。以下是对DataWorks产品使用合集的概述,涵盖数据处理的各个环节。
|
27天前
|
分布式计算 搜索推荐 物联网
大数据及AI典型场景实践问题之通过KafKa+OTS+MaxCompute完成物联网系统技术重构如何解决
大数据及AI典型场景实践问题之通过KafKa+OTS+MaxCompute完成物联网系统技术重构如何解决
|
27天前
|
人工智能 分布式计算 架构师
大数据及AI典型场景实践问题之基于MaxCompute构建Noxmobi全球化精准营销系统如何解决
大数据及AI典型场景实践问题之基于MaxCompute构建Noxmobi全球化精准营销系统如何解决
|
11天前
|
SQL 分布式计算 大数据
代码编码原则和规范大数据开发
此文档详细规定了SQL代码的编写规范,包括代码的清晰度,执行效率,以及注释的必要性。它强调所有SQL关键字需统一使用大写或小写,并禁止使用select *操作。此外,还规定了代码头部的信息模板,字段排列方式,INSERT, SELECT子句的格式,运算符的使用,CASE语句编写规则,查询嵌套规范,表别名定义,以及SQL注释的添加方法。这些规则有助于提升代码的可读性和可维护性。
12 0
|
11天前
|
SQL 分布式计算 大数据
大数据开发SQL代码编码原则和规范
这段SQL编码原则强调代码的功能完整性、清晰度、执行效率及可读性,通过统一关键词大小写、缩进量以及禁止使用模糊操作如select *等手段提升代码质量。此外,SQL编码规范还详细规定了代码头部信息、字段与子句排列、运算符前后间隔、CASE语句编写、查询嵌套、表别名定义以及SQL注释的具体要求,确保代码的一致性和维护性。
15 0
|
19天前
|
SQL 存储 分布式计算
MaxCompute 入门:大数据处理的第一步
【8月更文第31天】在当今数字化转型的时代,企业和组织每天都在产生大量的数据。有效地管理和分析这些数据变得至关重要。阿里云的 MaxCompute(原名 ODPS)是一个用于处理海量数据的大规模分布式计算服务。它提供了强大的存储能力以及丰富的数据处理功能,让开发者能够快速构建数据仓库、实时报表系统、数据挖掘等应用。本文将介绍 MaxCompute 的基本概念、架构,并演示如何开始使用这一大数据处理平台。
111 0
|
30天前
|
SQL 分布式计算 大数据
"大数据计算难题揭秘:MaxCompute中hash join内存超限,究竟该如何破解?"
【8月更文挑战第20天】在大数据处理领域,阿里云的MaxCompute以高效稳定著称,但复杂的hash join操作常导致内存超限。本文通过一个实例解析此问题:数据分析师小王需对两个共计300GB的大表进行join,却遭遇内存不足。经分析发现,单个mapper任务内存默认为2GB,不足以支持大型hash表的构建。为此,提出三种解决方案:1) 提升mapper任务内存;2) 利用map join优化小表连接;3) 实施分而治之策略,将大表分割后逐一处理再合并结果。这些方法有助于提升大数据处理效率及稳定性。
48 0
|
30天前
|
SQL 分布式计算 大数据
"揭秘MaxCompute大数据秘术:如何用切片技术在数据海洋中精准打捞?"
【8月更文挑战第20天】在大数据领域,MaxCompute(曾名ODPS)作为阿里集团自主研发的服务,提供强大、可靠且易用的大数据处理平台。数据切片是其提升处理效率的关键技术之一,它通过将数据集分割为小块来优化处理流程。使用MaxCompute进行切片可显著提高查询性能、支持并行处理、简化数据管理并增强灵活性。例如,可通过SQL按时间或其他维度对数据进行切片。此外,MaxCompute还支持高级切片技术如分区表和分桶表等,进一步加速数据处理速度。掌握这些技术有助于高效应对大数据挑战。
55 0
|
1月前
|
数据可视化
Echarts数据可视化开发| 智慧数据平台
Echarts数据可视化开发| 智慧数据平台
|
1月前
|
数据可视化
Echarts数据可视化大屏开发| 大数据分析平台
Echarts数据可视化大屏开发| 大数据分析平台

热门文章

最新文章

相关产品

  • 云原生大数据计算服务 MaxCompute