首先声明，此系列shell系列博客分为四篇发布，分别是：

　　面试篇：

10. Shell工具（重点）

10.1 cut

cut的工作就是“剪”，具体的说就是在文件中负责剪切数据用的。cut 命令从文件的每一行剪切字节、字符和字段并将这些字节、字符和字段输出。

1.基本用法

cut [选项参数]  filename

说明：默认分隔符是制表符

2.选项参数说明

参数表

选项参数	功能
-f	列号，提取第几列
-d	分隔符，按照指定分隔符分割列

3.案例实操

（0）数据准备

[fsdm@hadoop101 datas]$ touch cut.txt

[fsdm@hadoop101 datas]$ vim cut.txt

bei shen

jing zhen

wo  wo

lai  lai

le  le

　　注意：标红部分第三行，第四行，第五行，中间是两个空格第一行，第二行是一个空格

（1）切割cut.txt第一列

[fsdm@hadoop101 datas]$ cut -d " " -f  cut.txt

bei

jing

wo

lai

le

（2）切割cut.txt第二列

[fsdm@hadoop101 datas]$ cut -d " " -f , cut.txt

shen

zhen

（3）切割cut.txt第二、三列

[fsdm@hadoop101 datas]$ cut -d " " -f , cut.txt

shen

zhen

 wo

 lai

 le

（4）在cut.txt文件中切割出guan

[fsdm@hadoop101 datas]$ cat cut.txt | grep "guan" | cut -d " " -f

guan

（5）选取系统PATH变量值，第2个“：”开始后的所有路径：

[fsdm@hadoop101 datas]$ echo $PATH

/usr/lib64/qt-3.3/bin:/usr/local/bin:/bin:/usr/bin:/usr/local/sbin:/usr/sbin:/sbin:/home/fsdm/bin

[fsdm@hadoop102 datas]$ echo $PATH | cut -d: -f -

/usr/local/bin:/bin:/usr/bin:/usr/local/sbin:/usr/sbin:/sbin:/home/fsdm/bin

（6）切割ifconfig 后打印的IP地址

[fsdm@hadoop101 datas]$ ifconfig eth0 | grep "inet addr" | cut -d: -f  | cut -d" " -f1

192.168.1.102

10.2 sed

sed是一种流编辑器，它一次处理一行内容。处理时，把当前处理的行存储在临时缓冲区中，称为“模式空间”，接着用sed命令处理缓冲区中的内容，处理完成后，把缓冲区的内容送往屏幕。接着处理下一行，这样不断重复，直到文件末尾。文件内容并没有改变，除非你使用重定向存储输出。

1. 基本用法

sed [选项参数]  ‘command’  filename

2. 选项参数说明

参数表

选项参数	功能
-e	直接在指令列模式上进行sed的动作编辑。

3. 命令功能描述

功能描述表

命令	功能描述
a	新增，a的后面可以接字串，在下一行出现
d	删除
s	查找并替换

4. 案例实操

（0）数据准备

[fsdm@hadoop102 datas]$ touch sed.txt

[fsdm@hadoop102 datas]$ vim sed.txt

bei shen

jing zhen

wo  wo

lai  lai

le  le

（1）将“mei nv”这个单词插入到sed.txt第二行下，打印。

[fsdm@hadoop102 datas]$ sed '2a mei nv' sed.txt

dong shen

guan zhen

mei nv

wo  wo

lai  lai

le  le

[fsdm@hadoop102 datas]$ cat sed.txt

dong shen

guan zhen

wo  wo

lai  lai

le  le

注意：实际文件内容并没有改变

（2）删除sed.txt文件所有包含wo的行

[fsdm@hadoop102 datas]$ sed '/wo/d' sed.txt

dong shen

guan zhen

lai  lai

le  le

（3）将sed.txt文件中wo替换为ni

[fsdm@hadoop102 datas]$ sed 's/wo/ni/g' sed.txt

dong shen

guan zhen

ni  ni

lai  lai

le  le

注意：‘g’表示global，全部替换的意思

（4）将sed.txt文件中的第二行删除并将wo替换为ni

[fsdm@hadoop102 datas]$ sed -e '2d' -e 's/wo/ni/g' sed.txt

dong shen

ni  ni

lai  lai

le  le

10.3 awk

一个强大的文本分析工具，把文件逐行的读入，以空格为默认分隔符将每行切片，切开的部分再进行分析处理。

1. 基本用法

awk [选项参数] ‘pattern1{action1}  pattern2{action2}...’ filename

pattern：表示AWK在数据中查找的内容，就是匹配模式

action：在找到匹配内容时所执行的一系列命令

2. 选项参数说明

参数表

选项参数	功能
-F	指定输入文件折分隔符
-v	赋值一个用户定义变量

3. 案例实操

（0）数据准备

[fsdm@hadoop102 datas]$ sudo cp /etc/passwd ./

（1）搜索passwd文件以root关键字开头的所有行，并输出该行的第7列。

[fsdm@hadoop102 datas]$ awk -F: '/^root/{print $7}' passwd

/bin/bash

（2）搜索passwd文件以root关键字开头的所有行，并输出该行的第1列和第7列，中间以“，”号分割。

[fsdm@hadoop102 datas]$ awk -F: '/^root/{print $1","$7}' passwd

root,/bin/bash

注意：只有匹配了pattern的行才会执行action

（3）只显示/etc/passwd的第一列和第七列，以逗号分割，且在所有行前面添加列名user，shell在最后一行添加"dahaige，/bin/zuishuai"。

[fsdm@hadoop102 datas]$ awk -F : 'BEGIN{print "user, shell"} {print $1","$7} END{print "dahaige,/bin/zuishuai"}' passwd

user, shell

root,/bin/bash

bin,/sbin/nologin

。。。

fsdm,/bin/bash

dahaige,/bin/zuishuai

注意：BEGIN 在所有数据读取行之前执行；END 在所有数据执行之后执行。

（4）将passwd文件中的用户id增加数值1并输出

[fsdm@hadoop102 datas]$ awk -v i= -F: '{print $3+i}' passwd

4. awk的内置变量

变量表

变量	说明
FILENAME	文件名
NR	已读的记录数
NF	浏览记录的域的个数（切割后，列的个数）

5. 案例实操

（1）统计passwd文件名，每行的行号，每行的列数

[fsdm@hadoop102 datas]$ awk -F: '{print "filename:"  FILENAME ", linenumber:" NR  ",columns:" NF}' passwd

filename:passwd, linenumber:,columns:

filename:passwd, linenumber:,columns:

filename:passwd, linenumber:,columns:

（2）切割IP

[fsdm@hadoop102 datas]$ ifconfig eth0 | grep "inet addr" | awk -F: '{print $2}' | awk -F " " '{print $1}'

192.168.1.102

（3）查询sed.txt中空行所在的行号

[fsdm@hadoop102 datas]$ awk '/^$/{print NR}' sed.txt

10.4 sort

sort命令是在Linux里非常有用，它将文件进行排序，并将排序结果标准输出。

1. 基本语法

sort(选项)(参数)

参数表

选项	说明
-n	依照数值的大小排序
-r	以相反的顺序来排序
-t	设置排序时所用的分隔字符
-k	指定需要排序的列

参数：指定待排序的文件列表

2. 案例实操

（0）数据准备

[fsdm@hadoop102 datas]$ touch sort.sh

[fsdm@hadoop102 datas]$ vim sort.sh

bb::5.4

hehe::4.2

haha::2.3

heihei::3.5

ss::1.6

（1）按照“：”分割后的第三列倒序排序。

[fsdm@hadoop102 datas]$ sort -t : -nrk   sort.sh

bb::5.4

hehe::4.2

heihei::3.5

haha::2.3

ss::1.6

高级篇结束，如需深入请阅读后续篇章，如有疑问私信或评论指出

大数据系列博客之 --- 深入简出 Shell 脚本语言（高级篇）的更多相关文章

大数据系列博客之 --- 深入简出 Shell 脚本语言（提升篇）
首先声明,此系列shell系列博客分为四篇发布,分别是: 基础篇:https://www.cnblogs.com/lsy131479/p/9914747.html 提升篇:https://www.cn ...
大数据系列博客之 --- 深入简出 Shell 脚本语言（基础篇）
首先声明,此系列shell系列博客分为四篇发布,分别是: 基础篇:https://www.cnblogs.com/lsy131479/p/9914747.html 提升篇:https://www.cn ...
大数据系列（4）——Hadoop集群VSFTP和SecureCRT安装配置
前言经过前三篇文章的介绍,已经通过VMware安装了Hadoop的集群环境,当然,我相信安装的过程肯定遇到或多或少的问题,这些都需要自己解决,解决的过程就是学习的过程,本篇的来介绍几个Hadoop环 ...
窥探Swift系列博客说明及其Swift版本间更新
Swift到目前为止仍在更新,每次更新都会推陈出新,一些Swift旧版本中的东西在新Swift中并不适用,而且新版本的Swift会添加新的功能.到目前为止,Swift为2.1版本.去年翻译的Swift ...
大数据系列（5）——Hadoop集群MYSQL的安装
前言有一段时间没写文章了,最近事情挺多的,现在咱们回归正题,经过前面四篇文章的介绍,已经通过VMware安装了Hadoop的集群环境,相关的两款软件VSFTP和SecureCRT也已经正常安装了. ...
大数据系列（3）——Hadoop集群完全分布式坏境搭建
前言上一篇我们讲解了Hadoop单节点的安装,并且已经通过VMware安装了一台CentOS 6.8的Linux系统,咱们本篇的目标就是要配置一个真正的完全分布式的Hadoop集群,闲言少叙,进入本 ...
大数据系列（2）——Hadoop集群坏境CentOS安装
前言前面我们主要分析了搭建Hadoop集群所需要准备的内容和一些提前规划好的项,本篇我们主要来分析如何安装CentOS操作系统,以及一些基础的设置,闲言少叙,我们进入本篇的正题. 技术准备 VMwa ...
Django 系列博客（十四）
Django 系列博客(十四) 前言本篇博客介绍在 html 中使用 ajax 与后台进行数据交互. 什么是 ajax ajax(Asynchronous Javascript And XML)翻译 ...
Django 系列博客（十三）
Django 系列博客(十三) 前言本篇博客介绍 Django 中的常用字段和参数. ORM 字段 AutoField int 自增列,必须填入参数 primary_key=True.当 model ...

随机推荐

以前的 Delphi版本
Delphi 1 Delphi 2 Delphi 3 Delphi 4 Delphi 5 Delphi 6 Delphi 7 Delphi 8 Delphi 2005
shiroWeb项目-认证及MD5认证信息在页面显示(十)
realm设置完整认证信息 // realm的认证方法,从数据库查询用户信息 @Override protected AuthenticationInfo doGetAuthenticationInf ...
host-only
https://www.cnblogs.com/yaox/p/6635312.html
【Python】JBOSS-JMX-EJB-InvokerServlet批量检测工具
一.说明在JBoss服务器上部署web应用程序,有很多不同的方式,诸如:JMX Console.Remote Method Invocation(RMI).JMXInvokerServlet.Htt ...
Software development skills for data scientists
Software development skills for data scientists Data scientists often come from diverse backgrounds ...
Linux命令学习总结：date命令【转】
本文转自:http://www.cnblogs.com/kerrycode/p/3427617.html 命令简介: date 根据给定格式显示日期或设置系统日期时间.print or set the ...
yum install oracle-validated
背景当时心血来潮要在linux搞oracle,可一顿折腾,大约两个周时间,主要是各种环境的检测麻烦,在redhat上操作也不如centos有利. 命令 yum install oracle-vali ...
js篇之对象数据属性与存取器属性
在ECMAScript中,对象属性值可以用一个或两个方法代替,这两个方法就是getter和setter.由getter与与setter定义的属性叫做‘存取器属性’.当程序查询存取器属性的值时,js调用 ...
PHP 发送HTTP请求的几种方式
1.curl仍然是最好的HTTP库,没有之一. 可以解决任何复杂的应用场景中的HTTP 请求2. 文件流式的HTTP请求比较适合处理简单的HTTP POST/GET请求,但不适用于复杂的HTTP请求3 ...
LeetCode（57）：插入区间
Hard! 题目描述: 给出一个无重叠的 ,按照区间起始端点排序的区间列表. 在列表中插入一个新的区间,你需要确保列表中的区间仍然有序且不重叠(如果有必要的话,可以合并区间). 示例 1: 输入: i ...

大数据系列博客之 --- 深入简出 Shell 脚本语言（高级篇）

10. Shell工具（重点）

10.1 cut

10.2 sed

10.3 awk

10.4 sort

大数据系列博客之 --- 深入简出 Shell 脚本语言（高级篇）的更多相关文章

随机推荐

热门专题