基于阿里云平台的大数据教学案例 —— 各平台游戏的销量及评分分析

简介: 现在的时代,互联网发展越发的发达,随之带来兴起的电子游戏产业也越来越引起人们的重视。所以我们组在网上收集到了近年来关于各大平台所发行的一些游戏的相关发行量以及评分数据,根据这些数据利用阿里云的相关产品技术来进行分析过去和现在的哪些厂商的哪些游戏比较热门,做出可视化的图表,并为游戏厂商的未来所做游戏做一些参考。

一、实验题目
近年各平台游戏的销量及评分分析

二、实验目的
现在的时代,互联网发展越发的发达,随之带来兴起的电子游戏产业也越来越引起人们的重视。所以我们组在网上收集到了近年来关于各大平台所发行的一些游戏的相关发行量以及评分数据,根据这些数据利用阿里云的相关产品技术来进行分析过去和现在的哪些厂商的哪些游戏比较热门,做出可视化的图表,并为游戏厂商的未来所做游戏做一些参考。

三、实验难点
混淆矩阵的使用与Sql语句的编写

四、实验过程
数据集的描述:
image.png

一共16720条数据

Maxcompute
创建数据表:

CREATE TABLE IF NOT EXISTS video_game_sales1
(
name STRING,
platform STRING,
year_of_release STRING,
genre STRING,
publisher STRING,
na_sales DOUBLE,
eu_sales DOUBLE,
jp_sales DOUBLE,
other_sales DOUBLE,
global_sales DOUBLE,
critic_score STRING,
critic_count STRING,
user_score STRING,
user_count STRING,
developer STRING,
rating STRING
) ;

image.png

共140000+条数据,来源于互联网下载
字段的含义:
Name:游戏名
Platfrom:游戏平台
Year_of_relese 每年发售的游戏数
Genre 游戏类型
Publisher 发行商
Na_sales 北美销量
jp_sales 日本销量
other_sales 其他销量
global_sales 全球销量
Critic_score 评论家分数
Critic_count 评论家数量
User_score 用户评分
User_count 用户数量
Developer 制作商
Rating 评级

机器学习PAI
找到dotaworks里的数据源,然后创建不同平台的游戏总数表:

SELECT platform,
count(platform) as 游戏总数 from video_game_sales1 group by platform

利用混淆矩阵随机森林制作预测表:
image.png

利用混淆矩阵和随机森林制作年份游戏数量预测准确率

四个不同地区的游戏销量:

select Genre,sum(NA_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(EU_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(JP_Sales) as 销售数量 from video_game_sales1 group by Genre

image.png

四个不同地区的游戏销量:

select Genre,sum(NA_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(EU_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(JP_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(GLOBAL_Sales) as 销售数量 from video_game_sales1 group by Genre

image.png

不同年份的游戏销售额:

select Year_of_Release,sum(Global_Sales) as 总销售额 from video_game_sales1 group by Year_of_Release

数据表展示:
image.png
image.png
image.png
image.png
image.png
image.png

QuickBi:
把数据源添加到数据集后在面板上填入对应的维度和度量
image.png
image.png
image.png
image.png

总结:
根据本项目分析得来的数据,以及可视化结果显示:随着时间的增长,各大厂商所发行的游戏数量也都有都有所增长,玩家购买的数量也是增长的。在近年来动作游戏最受玩家们的欢迎,运动和射击游戏紧随其后,策略游戏和解谜游戏玩家受众群较少。

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
目录
相关文章
|
10月前
|
数据可视化 关系型数据库 MySQL
基于python大数据的的海洋气象数据可视化平台
针对海洋气象数据量大、维度多的挑战,设计基于ECharts的可视化平台,结合Python、Django与MySQL,实现数据高效展示与交互分析,提升科研与决策效率。
|
数据采集 人工智能 大数据
10倍处理效率提升!阿里云大数据AI平台发布智能驾驶数据预处理解决方案
阿里云大数据AI平台推出智能驾驶数据预处理解决方案,助力车企构建高效稳定的数据处理流程。相比自建方案,数据包处理效率提升10倍以上,推理任务提速超1倍,产能翻番,显著提高自动驾驶模型产出效率。该方案已服务80%以上中国车企,支持多模态数据处理与百万级任务调度,全面赋能智驾技术落地。
1633 0
|
11月前
|
人工智能 运维 搜索推荐
大数据+游戏:原来玩家的快乐还能这样被“算”出来?
大数据+游戏:原来玩家的快乐还能这样被“算”出来?
992 11
|
10月前
|
传感器 人工智能 监控
拔俗多模态跨尺度大数据AI分析平台:让复杂数据“开口说话”的智能引擎
在数字化时代,多模态跨尺度大数据AI分析平台应运而生,打破数据孤岛,融合图像、文本、视频等多源信息,贯通微观与宏观尺度,实现智能诊断、预测与决策,广泛应用于医疗、制造、金融等领域,推动AI从“看懂”到“会思考”的跃迁。
757 0
|
分布式计算 算法 大数据
大数据时代的智能研发平台需求与阿里云DIDE的定位
阿里云DIDE是一站式智能大数据开发与治理平台,致力于解决传统大数据开发中的效率低、协同难等问题。通过全面整合资源、高度抽象化设计及流程自动化,DIDE显著提升数据处理效率,降低使用门槛,适用于多行业、多场景的数据开发需求,助力企业实现数字化转型与智能化升级。
667 1
|
机器学习/深度学习 存储 Java
Java 大视界 -- Java 大数据机器学习模型在游戏用户行为分析与游戏平衡优化中的应用(190)
本文探讨了Java大数据与机器学习模型在游戏用户行为分析及游戏平衡优化中的应用。通过数据采集、预处理与聚类分析,开发者可深入洞察玩家行为特征,构建个性化运营策略。同时,利用回归模型优化游戏数值与付费机制,提升游戏公平性与用户体验。
|
关系型数据库 MySQL 大数据
大数据新视界--大数据大厂之MySQL 数据库课程设计:MySQL 数据库 SQL 语句调优的进阶策略与实际案例(2-2)
本文延续前篇,深入探讨 MySQL 数据库 SQL 语句调优进阶策略。包括优化索引使用,介绍多种索引类型及避免索引失效等;调整数据库参数,如缓冲池、连接数和日志参数;还有分区表、垂直拆分等其他优化方法。通过实际案例分析展示调优效果。回顾与数据库课程设计相关文章,强调全面认识 MySQL 数据库重要性。为读者提供综合调优指导,确保数据库高效运行。
|
存储 资源调度 云计算
什么是云计算平台?如何打造云平台核心要件?
云计算平台基于虚拟化和分布式计算技术,提供灵活、可扩展的计算资源与服务框架,支持跨地域的数据处理和应用运行。它通过集中管理资源、优化分配,提高系统可用性和响应速度,降低运营成本,增强用户体验。平台分为IaaS、PaaS和SaaS三层架构,具备动态资源调度、多租户隔离和服务可靠性等优势。构建要素包括基础框架设计、关键技术组件及运维支撑体系,确保高效、安全的云服务交付。
2698 3
|
SQL 存储 HIVE
鹰角基于 Flink + Paimon + Trino 构建湖仓一体化平台实践项目
鹰角基于 Flink + Paimon + Trino 构建湖仓一体化平台实践项目
1112 2