开发者社区> 学堂小助手> 正文

文本处理命令 | 学习笔记

简介: 快速学习文本处理命令。
+关注继续查看

开发者学堂课程【Linux 文本处理、正则表达式与 Vim:文本处理命令】学习笔记,与课程紧密联系,让用户快速学习知识。

课程地址:https://developer.aliyun.com/learning/course/592/detail/8350


文本处理命令


内容介绍

一、文本处理工具


一、文本处理工具

1、文件查看

u 文件查看命令:

cat,tac,rev

u cat[OPTION]...[FILE]...

-E:显示行结束符$

-n:对显示出的每一行进行编号

-A:显示所有控制符

-b:非空行编号

-s:压缩连续的空行成一行

u tac

u Rev

2、分页查看文件内容

u more: 分页查看文件

more [OPTIONS...] FILE...

-d: 显示翻页及退出提示

u less: 一页一页地查看文件或 STDIN 输出

查看时有用的命令包括:

/文本 搜索  文本

n/N  跳到下一个或上一个匹配

less 命令是 man 命令使用的分页器

3、显示文本前或后行内容

u head [OPTION]... [FILE]...

-C#:指定获取前#字节

-n#:指定获取前#行

-#:指定行数

u tail [OPTION]... [FILE]...

-c#:指定获取后#字节

-n#:指定获取后#行

-#:同上

-f:跟踪显示文件 fd 新追加的内容,常用日志监控相当于--follow=descriptor

-F:跟踪文件名,相当于--follow=name--retry

u Tailf 类似 tail-f,当文件不增长时并不访问文件

4、按列抽取文本 cut 和合并文件 paste

u cut [OPTION]... [FILE]...

-d DELIMITER:指明分隔符,默认 tab

-f FILEDS

#:第#个字段

#,#[,#]:离散的多个字段,例如1,3,6

#-#:连续的多个字段,例如1-6

混合使用:1-3,7

-C 按字符切割

--output-delimiter=STRING 指定输出分隔符

5、Cut 和 paste

u 显示文件或 STDIN 数据的指定列

cut -d:-f1/etc/passwd

cat /etc/passwd | cut-d:-f7

cut-c2-5/usr/share/dict/words

u Paste 合并两个文件同行号的列到一行

paste [OPTION]... [FILE]...

-d分隔符:指定分隔符,默认用 TAB

-S:所有行合成一行显示

示例:

paste f1 f2

paste -s f1 f2

6、收集文本统计数据 wc

u 计数单词总数、行总数、字节总数和字符总数

u 可以对文件或 STDIN 中的数据运行

wc story.txt

39 237  1901 story.txt

行数 字数 字节数

u 常用选项

-I 只计数行数

-W 只计数单词总数

-C 只计数字节总数

-m 只计数字符总数

-L 显示文件中最长行的长度

版权声明:本文内容由阿里云实名注册用户自发贡献,版权归原作者所有,阿里云开发者社区不拥有其著作权,亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容,填写侵权投诉表单进行举报,一经查实,本社区将立刻删除涉嫌侵权内容。

相关文章
文本分析和处理 awk|学习笔记
快速学习文本分析和处理 awk
46 0
线程同步处理|学习笔记
快速学习 线程同步处理
29 0
阿里云服务器如何登录?阿里云服务器的三种登录方法
购买阿里云ECS云服务器后如何登录?场景不同,阿里云优惠总结大概有三种登录方式: 登录到ECS云服务器控制台 在ECS云服务器控制台用户可以更改密码、更换系.
24839 0
Angular内部对template的处理学习笔记
Angular内部对template的处理学习笔记
19 0
自定义 ClassLoader 处理类|学习笔记
快速学习自定义 ClassLoader 处理类
22 0
图解大数据 | Spark Streaming @流式数据处理
Spark Streaming是Spark核心API的一个扩展,可以实现实时数据的可拓展,高吞吐量。本文讲解Spark Streaming的架构、作业提交和工作原理,以及DStream的创建、转换和Graph,并通过案例代码展示应用的细节。
50 0
序列化与反序列化处理|学习笔记
快速学习 序列化与反序列化处理
35 0
阿里云服务器端口号设置
阿里云服务器初级使用者可能面临的问题之一. 使用tomcat或者其他服务器软件设置端口号后,比如 一些不是默认的, mysql的 3306, mssql的1433,有时候打不开网页, 原因是没有在ecs安全组去设置这个端口号. 解决: 点击ecs下网络和安全下的安全组 在弹出的安全组中,如果没有就新建安全组,然后点击配置规则 最后如上图点击添加...或快速创建.   have fun!  将编程看作是一门艺术,而不单单是个技术。
18066 0
1783
文章
0
问答
来源圈子
更多
技术图谱:由专家组参与技术图谱的绘制与编写,知识与实践的结合让开发者们掌握学习路线与逻辑,快速提升技能 电子书:电子书由阿里内外专家打造,供开发者们下载学习,更与课程相结合,使用户更易理解掌握课程内容 训练营:学习训练营 深入浅出,专家授课,带领开发者们快速上云 精品课程:汇集知识碎片,解决技术难题,体系化学习场景,深入浅出,易于理解 技能自测:提供免费测试,摸底自查 体验实验室:学完即练,云资源免费使用
+ 订阅
文章排行榜
最热
最新
相关电子书
更多
OceanBase 入门到实战教程
立即下载
阿里云图数据库GDB,加速开启“图智”未来.ppt
立即下载
实时数仓Hologres技术实战一本通2.0版(下)
立即下载