大数据开发(必备)

本文涉及的产品
云原生大数据计算服务MaxCompute,500CU*H 100GB 3个月
简介: package:大数据开发(面试以及工作)技能public class(java->大数据):java转型大数据开发。调研技术。学习机制原理。熟悉源代码。

package:

大数据开发(面试以及工作)技能

public class(java->大数据):

java转型大数据开发。调研技术。学习机制原理。熟悉源代码。

class java:

精通java(java基础知识扎实 + java通用类库以及框架)

深入理解Java虚拟机

精通多线程

spring+hibernate框架

osgi框架

数据结构与算法(#算法导论#)

工具类(git、maven、sbt等等)

........

class sql:

mysql

hbase

redis

........

class hadoop

hdfs

mapreduce

hbase

flume

kafka

sqoop

oozie可选

solr(solrcloud)

zookeeper

yarn

........

以上:hadoop集群搭建、终端shell开发,Java——api开发,组件原理机制,熟读源代码。

class sql-on-hadoop

hive

phoenix

impala

class spark

scala

spark-mllib

spark-streaming

spark-sql

........

method all()

项目开发+技术调研+技术总结+底层机制+源代码+二次开发

学习指南:

============================================================

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
目录
相关文章
|
SQL 分布式计算 DataWorks
DataWorks产品使用合集之如何开发ODPS Spark任务
DataWorks作为一站式的数据开发与治理平台,提供了从数据采集、清洗、开发、调度、服务化、质量监控到安全管理的全套解决方案,帮助企业构建高效、规范、安全的大数据处理体系。以下是对DataWorks产品使用合集的概述,涵盖数据处理的各个环节。
281 2
|
SQL 存储 分布式计算
ODPS开发大全:入门篇(3)
ODPS开发大全:入门篇
729 19
|
SQL 存储 分布式计算
ODPS开发大全:入门篇(1)
ODPS开发大全:入门篇
1324 14
|
SQL 分布式计算 资源调度
ODPS开发大全:进阶篇(1)
ODPS开发大全:进阶篇
1084 13
|
9月前
|
数据采集 机器学习/深度学习 DataWorks
DataWorks产品评测:大数据开发治理的深度体验
DataWorks产品评测:大数据开发治理的深度体验
385 1
|
SQL 分布式计算 MaxCompute
ODPS开发大全:入门篇(2)
ODPS开发大全:入门篇
673 14
|
SQL 分布式计算 MaxCompute
SQL开发问题之对于ODPS中的UNION操作,执行计划的问题如何解决
SQL开发问题之对于ODPS中的UNION操作,执行计划的问题如何解决
235 7
|
分布式计算 运维 DataWorks
MaxCompute操作报错合集之用户已在DataWorks项目中,并有项目的开发和运维权限,下载数据时遇到报错,该如何解决
MaxCompute是阿里云提供的大规模离线数据处理服务,用于大数据分析、挖掘和报表生成等场景。在使用MaxCompute进行数据处理时,可能会遇到各种操作报错。以下是一些常见的MaxCompute操作报错及其可能的原因与解决措施的合集。
203 8
|
SQL 分布式计算 资源调度
ODPS开发大全:进阶篇(4)
ODPS开发大全:进阶篇
605 10
|
SQL 分布式计算 Java
ODPS开发大全:进阶篇(3)
ODPS开发大全:进阶篇
389 9

热门文章

最新文章