基于阿里云平台的大数据教学案例 —— 各平台游戏的销量及评分分析

简介: 现在的时代,互联网发展越发的发达,随之带来兴起的电子游戏产业也越来越引起人们的重视。所以我们组在网上收集到了近年来关于各大平台所发行的一些游戏的相关发行量以及评分数据,根据这些数据利用阿里云的相关产品技术来进行分析过去和现在的哪些厂商的哪些游戏比较热门,做出可视化的图表,并为游戏厂商的未来所做游戏做一些参考。

一、实验题目
近年各平台游戏的销量及评分分析

二、实验目的
现在的时代,互联网发展越发的发达,随之带来兴起的电子游戏产业也越来越引起人们的重视。所以我们组在网上收集到了近年来关于各大平台所发行的一些游戏的相关发行量以及评分数据,根据这些数据利用阿里云的相关产品技术来进行分析过去和现在的哪些厂商的哪些游戏比较热门,做出可视化的图表,并为游戏厂商的未来所做游戏做一些参考。

三、实验难点
混淆矩阵的使用与Sql语句的编写

四、实验过程
数据集的描述:
image.png

一共16720条数据

Maxcompute
创建数据表:

CREATE TABLE IF NOT EXISTS video_game_sales1
(
name STRING,
platform STRING,
year_of_release STRING,
genre STRING,
publisher STRING,
na_sales DOUBLE,
eu_sales DOUBLE,
jp_sales DOUBLE,
other_sales DOUBLE,
global_sales DOUBLE,
critic_score STRING,
critic_count STRING,
user_score STRING,
user_count STRING,
developer STRING,
rating STRING
) ;

image.png

共140000+条数据,来源于互联网下载
字段的含义:
Name:游戏名
Platfrom:游戏平台
Year_of_relese 每年发售的游戏数
Genre 游戏类型
Publisher 发行商
Na_sales 北美销量
jp_sales 日本销量
other_sales 其他销量
global_sales 全球销量
Critic_score 评论家分数
Critic_count 评论家数量
User_score 用户评分
User_count 用户数量
Developer 制作商
Rating 评级

机器学习PAI
找到dotaworks里的数据源,然后创建不同平台的游戏总数表:

SELECT platform,
count(platform) as 游戏总数 from video_game_sales1 group by platform

利用混淆矩阵随机森林制作预测表:
image.png

利用混淆矩阵和随机森林制作年份游戏数量预测准确率

四个不同地区的游戏销量:

select Genre,sum(NA_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(EU_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(JP_Sales) as 销售数量 from video_game_sales1 group by Genre

image.png

四个不同地区的游戏销量:

select Genre,sum(NA_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(EU_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(JP_Sales) as 销售数量 from video_game_sales1 group by Genre
select Genre,sum(GLOBAL_Sales) as 销售数量 from video_game_sales1 group by Genre

image.png

不同年份的游戏销售额:

select Year_of_Release,sum(Global_Sales) as 总销售额 from video_game_sales1 group by Year_of_Release

数据表展示:
image.png
image.png
image.png
image.png
image.png
image.png

QuickBi:
把数据源添加到数据集后在面板上填入对应的维度和度量
image.png
image.png
image.png
image.png

总结:
根据本项目分析得来的数据,以及可视化结果显示:随着时间的增长,各大厂商所发行的游戏数量也都有都有所增长,玩家购买的数量也是增长的。在近年来动作游戏最受玩家们的欢迎,运动和射击游戏紧随其后,策略游戏和解谜游戏玩家受众群较少。

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
目录
相关文章
|
11月前
|
存储 分布式计算 大数据
基于Python大数据的的电商用户行为分析系统
本系统基于Django、Scrapy与Hadoop技术,构建电商用户行为分析平台。通过爬取与处理海量用户数据,实现行为追踪、偏好分析与个性化推荐,助力企业提升营销精准度与用户体验,推动电商智能化发展。
|
11月前
|
数据可视化 关系型数据库 MySQL
基于python大数据的的海洋气象数据可视化平台
针对海洋气象数据量大、维度多的挑战,设计基于ECharts的可视化平台,结合Python、Django与MySQL,实现数据高效展示与交互分析,提升科研与决策效率。
|
数据可视化 搜索推荐 大数据
基于python大数据的北京旅游可视化及分析系统
本文深入探讨智慧旅游系统的背景、意义及研究现状,分析其在旅游业中的作用与发展潜力,介绍平台架构、技术创新、数据挖掘与服务优化等核心内容,并展示系统实现界面。
|
数据采集 人工智能 分布式计算
ODPS在AI时代的发展战略与技术演进分析报告
ODPS(现MaxCompute)历经十五年发展,从分布式计算平台演进为AI时代的数据基础设施,以超大规模处理、多模态融合与Data+AI协同为核心竞争力,支撑大模型训练与实时分析等前沿场景,助力企业实现数据驱动与智能化转型。
792 4
|
JSON 大数据 API
巧用苏宁易购 API,精准分析苏宁易购家电销售大数据
在数据驱动的电商时代,精准分析销售数据能助力企业优化库存、提升营销效果。本文详解如何利用苏宁易购API获取家电销售数据,结合Python进行数据清洗与统计分析,实现销量预测与洞察提取,帮助企业降本增效。
|
12月前
|
存储 SQL 分布式计算
终于!大数据分析不用再“又要快又要省钱”二选一了!Dataphin新功能太香了!
Dataphin推出查询加速新功能,支持用StarRocks等引擎直连MaxCompute或Hadoop查原始数据,无需同步、秒级响应。数据只存一份,省成本、提效率,权限统一管理,打破“又要快又要省”的不可能三角,助力企业实现分析自由。
564 49
|
11月前
|
机器学习/深度学习 大数据 关系型数据库
基于python大数据的台风灾害分析及预测系统
针对台风灾害预警滞后、精度不足等问题,本研究基于Python与大数据技术,构建多源数据融合的台风预测系统。利用机器学习提升路径与强度预测准确率,结合Django框架实现动态可视化与实时预警,为防灾决策提供科学支持,显著提高应急响应效率,具有重要社会经济价值。
|
11月前
|
机器学习/深度学习 大数据 关系型数据库
基于python大数据的青少年网络使用情况分析及预测系统
本研究基于Python大数据技术,构建青少年网络行为分析系统,旨在破解现有防沉迷模式下用户画像模糊、预警滞后等难题。通过整合多平台亿级数据,运用机器学习实现精准行为预测与实时干预,推动数字治理向“数据驱动”转型,为家庭、学校及政府提供科学决策支持,助力青少年健康上网。
|
12月前
|
数据采集 数据可视化 关系型数据库
基于python大数据的电影数据可视化分析系统
电影分析与可视化平台顺应电影产业数字化趋势,整合大数据处理、人工智能与Web技术,实现电影数据的采集、分析与可视化展示。平台支持票房、评分、观众行为等多维度分析,助力行业洞察与决策,同时提供互动界面,增强观众对电影文化的理解。技术上依托Python、MySQL、Flask、HTML等构建,融合数据采集与AI分析,提升电影行业的数据应用能力。