HDFS建筑与shell操作

简介:

一个、hadoop1.1.0演示

  1.  hadoop它适合于大容量数据存储和分布式计算平台
  2.  hadoop核心由hdfs和mapreduce组成
  3.  hdfs这是一个主从结构,仅有一个。是namenode:从节点有非常多个
  4.  分布式文件系统与HDFS (HDFS体系结构与基本概念)
  5.  Distributed File System
  6.  数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到很多其它的操作系统管理的磁盘中。可是不方便管理和维护,因此迫切须要一种系统来管理多台机器上  的文件,这就是分布式文件管理系统 。
  7.  是一种同意文件通过网络在多台主机上分享的文件系统,可让多机器上的多用户分享文件和存储空间。
  8.  通透性。

    让实际上是通过网络来訪问文件的动作。由程序与用户看来。就像是訪问本地的磁盘一般。

  9.  容错。即使系统中有某些节点脱机,总体来说系统仍然能够持续运作而不会有数据损失。
  10.  分布式文件管理系统非常多,hdfs仅仅是当中一种。适用于一次写入多次查询的情况,不支持并发写情况,小文件不合适。

二、HDFS的shell操作

  1. 调用文件系统(FS)Shell命令应使用 bin/hadoop fs 的形式。

  2. 全部的FS shell命令使用URI路径作为參数。

  3. URI格式是scheme://authority/path。HDFS的scheme是hdfs,对本地文件系统,scheme是file。

    当中scheme和authority參数都是可选的。如果未加指定,就会使用配置中指定的默认scheme。

  4. 比如:/parent/child能够表示成hdfs://namenode:namenodePort/parent/child。或者更简单的/parent/child(如果配置文件是namenode:namenodePort)
  5. 大多数FS Shell命令的行为和相应的Unix Shell命令类似。
三、HDFS经常使用命令

  -help [cmd] //显示命令的帮助信息

 -ls(r) <path> //显示当前文件夹下全部文件

 -du(s) <path> //显示文件夹中全部文件大小

 -count[-q] <path> //显示文件夹中文件数量

 -mv <src> <dst> //移动多个文件到目标文件夹

 -cp <src> <dst> //复制多个文件到目标文件夹

 -rm(r) //删除文件(夹)

 -put <localsrc> <dst> //本地文件拷贝到hdfs

 -copyFromLocal //同put

 -moveFromLocal //从本地文件移动到hdfs

 -get [-ignoreCrc] <src> <localdst> //拷贝文件到本地。能够忽略crc校验

 -getmerge <src> <localdst> //将源文件夹中的全部文件排序合并到一个文件里

 -cat <src> //在终端显示文件内容

 -text <src> //在终端显示文件内容

-copyToLocal [-ignoreCrc] <src> <localdst>  //拷贝到本地

-moveToLocal <src> <localdst>

-mkdir <path> //创建目录

-touchz <path> //创建一个空文件

HDFS 的shell练习

hadoop fs -ls /  查看HDFS根文件夹

hadoop fs -mkdir /test 在根文件夹创建一个文件夹test

hadoop fs -mkdir /test1 在根文件夹创建一个文件夹test1


版权声明:本文博客原创文章。博客,未经同意,不得转载。






本文转自mfrbuaa博客园博客,原文链接:http://www.cnblogs.com/mfrbuaa/p/4752051.html,如需转载请自行联系原作者


相关文章
|
5月前
|
Java API Maven
HDFS的API操作
HDFS的API操作
56 0
|
5月前
|
人工智能 机器人 Shell
【shell】shell字符串操作(声明、长度、拼接、切片、转换、替换等操作)
【shell】shell字符串操作(声明、长度、拼接、切片、转换、替换等操作)
|
5月前
|
存储 算法 Shell
【Shell 命令集合 磁盘维护 】Linux 对软盘进行格式化操作 fdformat命令使用指南
【Shell 命令集合 磁盘维护 】Linux 对软盘进行格式化操作 fdformat命令使用指南
60 0
|
5月前
|
Linux Shell 文件存储
【Linux技术专题】「夯实基本功系列」带你一同学习和实践操作Linux服务器必学的Shell指令(深入df和dh的区别和探索)
【Linux技术专题】「夯实基本功系列」带你一同学习和实践操作Linux服务器必学的Shell指令(深入df和dh的区别和探索)
156 1
|
3月前
|
分布式计算 Hadoop 关系型数据库
实时计算 Flink版操作报错合集之Hadoop在将文件写入HDFS时,无法在所有指定的数据节点上进行复制,该如何解决
在使用实时计算Flink版过程中,可能会遇到各种错误,了解这些错误的原因及解决方法对于高效排错至关重要。针对具体问题,查看Flink的日志是关键,它们通常会提供更详细的错误信息和堆栈跟踪,有助于定位问题。此外,Flink社区文档和官方论坛也是寻求帮助的好去处。以下是一些常见的操作报错及其可能的原因与解决策略。
|
4月前
|
Java 大数据 API
【大数据】HDFS、HBase操作教程(含指令和JAVA API)
【大数据】HDFS、HBase操作教程(含指令和JAVA API)
120 0
【大数据】HDFS、HBase操作教程(含指令和JAVA API)
|
4月前
|
分布式计算 Hadoop Java
分布式系统详解--框架(Hadoop--JAVA操作HDFS文件)
分布式系统详解--框架(Hadoop--JAVA操作HDFS文件)
36 0
|
4月前
|
存储 Shell 开发者
Shell 数组:灵活操作的秘诀
**Shell 数组简介**:作为基础数据结构,数组在Shell编程中不可或缺。它们存储多个值,下标从0开始。创建如`array=(值1 值2...)`,访问用`${array[index]}`。增删改查及获取长度、拼接数组都有相应语法,例如`unset array[index]`删除元素,`${#array[@]}`获取长度。通过实践这些操作,提升Shell脚本技能。
22 0
|
5月前
|
分布式计算 IDE Hadoop
实验:熟悉常用的HDFS操作
实验:熟悉常用的HDFS操作
43 3
|
4月前
|
机器学习/深度学习 Shell Linux
linux shell脚本判断文件或文件夹是否存在循环操作
linux shell脚本判断文件或文件夹是否存在循环操作
113 0