百度360必应搜狗淘宝本站头条
当前位置:网站首页 > IT知识 > 正文

今日推荐:shell 三剑客之文本处理工具awk

liuian 2024-12-14 13:33 22 浏览

背景

awk 是一个文本处理工具,通常用于处理数据并生成结果报告

awk 的命名是它的创始人 Alfred Aho、Peter Weinberger 和 Brian Kernighan 姓氏的首个字母组成的。

awk 实质上是一门编程语言,其具备自己的语法,如:条件判断、循环等等。在很多方面类似 shell 编程语言。

在测试工作中,我们可以利用它来帮助我们提升测试效率,比如:分析日志,格式化统计结果等等。

awk 语法格式

awk [option] 'pattern{action}' filename

action

接下来我们来学习最简单的 action-print

root@lemonban:/home/test# cat hello.txt
hello lemon
Tester Developer 
Java Python
  • 逐行打印每行内容,$0 是 awk 的内置变量,效果是打印整行内容
root@lemonban:/home/test# awk '{print $0}' hello.txt
hello lemon
Tester Developer 
Java Python
  • 每行以空格为分隔,逐行打印出第一列内容
root@lemonban:/home/test# awk '{print $1}' hello.txt
hello
Tester
Java
  • 每行以空格为分隔,逐行打印出第一列 第二列 内容
root@lemonban:/home/test# awk '{print $1,$2}' hello.txt
hello lemon 
Tester Developer 
Java Python

action 是被{}包裹的内容

awk 的工作模式是逐行以指定的分隔符将行分成多个字段,上述的例子没有指定分隔符,那么将会以默认的分隔符空格进行分割,每一个分割的字段分别对应着 awk 的内置变量 $1,$2...,其中 $0 是代表整行内容。

awk 内置变量

除了 $0,$1,$2...之外,awk 还有很多内置变量,下表中是常用的 awk 内置变量:

$0

整行内容

$1-$n

当前行的第 1-n 个字段

NF

当前行的字段个数,也就是有多少列

NR

当前行的行号,从 1 开始计数

FNR

多文件处理时,每个文件行号单独计数,都是从 0 开始

FS

输入字段分隔符,不指定默认以空格或 tab 键分割

RS

输入行分隔符,默认回车换行

OFS

输出字段分隔符,默认为空格

ORS

输出行分隔符,默认为回车换行

NR,NF 输出

root@lemonban:/home/test# awk '{print NR,NF}' hello.txt
1 2
2 2
3 2

如果不想以默认的空格作为字段分隔符,那么我们可以通过 FS 内置变量指定新的分隔符

  • 文件内容更改如下:
root@lemonban:/home/test# cat hello.txt
hello|lemon
Tester|Developer 
Java|Python
  • 指定"|"为新的分隔符,其中-v 参数表示指定输入分隔符(即在处理文件之前):
root@lemonban:/home/test# awk -v FS='|' '{print $1,$2}' hello.txt
hello lemon
Tester Developer 
Java Python
  • 默认输出分隔符也是空格,可以指定-v OFS 改变输出分隔符
root@lemonban:/home/test# awk -v FS='|' -v OFS='::' '{print $1,$2}' hello.txt
hello::lemon
Tester::Developer 
Java::Python

pattern 模式

上面我们学习到了 option 参数中的-v 参数以及 action 中的 print 动作,pattern 有何用处呢?

当 awk 进行逐行处理的时候,pattern 作为条件去判断将要被处理的行是否满足条件,如果满足则处理,否则不处理。

需要注意的是 action 是一定会被{}包裹的,而 pattern 则没有被{}包裹着的

空模式

默认 pattern 为空模式,比如上述的:

awk '{print $1}' testfile

文本中的每一行,都满足条件,都会执行相应的操作

BEGIN/END 模式

在开始逐行处理文本之前,先执行 BEGIN 模式所指定的动作,一般我们将其用于表头

awk 'BEGIN{print “hello”,”lemonban”}'

在所有文本处理完毕之后,执行 END 模式所指定的动作,一般用于末尾说明

awk 'BEGIN{print “hello”,”lemonban”}{print $1,$2}END{print “end of file”}'

示例:

root@lemonban:/home/test# awk 'BEGIN{print "name","age"}{print $1,$2}END{print "no more data"}' hello.txt
name age
zhangsan 25
lisi 30
wangwu 28
no more data

正则模式

使用语法:

awk '/正则表达式/{action}' filename

其中,正则表达式需要通过//包裹起来

示例:

  • 查找 passwd 中以 MySQL 开头的信息
root@lemonban:/home/test# awk '/^mysql/{print $0}' /etc/passwd
mysql:x:105:114:MySQL Server,,,:/nonexistent:/bin/false
  • 结合-v 参数指定输入分隔符为":"
root@lemonban:/home/test# awk -v FS=':' '/^mysql/{print $1,$2}' /etc/passwd
mysql x
  • 需要注意的是如果正则表达式中有斜杠"/",那么需要进行转义:
root@lemonban:/home/test# awk '/\/bin\/bash$/{print $0}' /etc/passwd
root:x:0:0:root:/root:/bin/bash

上述表达式是查找以/bin/bash 结束对应行的信息

比较表达式模式

所谓比较表达式是指有关系运算符参与运算,比如 >,<,>=,<= 等等

示例:查找 2 行以后所有行的内容

root@lemonban:/home/test# awk 'NR>2{print $0}' hello.txt
wangwu 28

查找字段最后一个是 30 所在行内容

root@lemonban:/home/test# awk '$NF==30{print $0}' hello.txt
lisi 30

这里的 NF 表示所在行字段个数,$NF 即表示所在行最后一个字段。

总结

本篇文章给大家介绍了 awk 的基本语法及 action、pattern、option 的使用。

awk 作为强大的编程工具,由于文章篇幅有限 awk 还有更多的特性没有介绍,大家如果感兴趣可以自行查阅相关资料学习。

本文作者:柠檬班软件测试(lemonban)——专注于最新最前沿的软件测试技术,解决你的测试技术烦恼,对软件测试感兴趣的朋友赶快关注我们吧!

相关推荐

HR必备Excel函数:4个与日期相关的计算函数。

提到日期函数,很多人首先会想到“today”,它可以显示当天的日期,并且每次打开表格时都会自动更新。但是,对于前天、昨天、明天和后天的日期,就不能用yesterday或者tomorrow等这些英文了,...

这篇文章有点长,但可以让你十分钟玩转Excel的时间函数

日期与时间函数——TODAY、NOW、YEAR、MONTH、DAY!如何用WORKDAY函数查询距离某天的第20个工作日是哪一天?如何用NETWORKDAYS函数查询员工工作了多少个工作日?如何用WE...

Excel2020年日历套装,表格设计,农历显示,查阅套打轻松应用

Hello大家好,我是帮帮。今天跟大家分享一组Excel2020年日历套装,表格设计,自带农历控件,查阅套打轻松应用。有个好消息!为了方便大家更快的掌握技巧,寻找捷径。请大家点击文章末尾的“了解更多”...

巧用NETWORKDAYS函数计算两个日期之间工作日的天数

带有日期的单元格是我们日常使用EXCEL的时候经常见到的,有的时候我们需要求出两个日期之间间隔的天数,可以直接用结束日期减去开始日期即可,这是个非常简单的减法公式。不过这个单纯的减法公式会默认去掉开始...

Excel按工作日、休息日进行汇总

1、按周六日/其它时间汇总为了区分一周的周六日和其它时间,可以使用WEEKDAY函数,把WEEKDAY函数的第2个参数指定为2,如WEEKDAY(A3,2),则周一返回1,周二返回2,…,周六返回...

如何计算每月应出勤天数,如有法定假期和调休,如何计算

本文介绍如何计算每月的应出勤天数。第一部分介绍正常双休制下计算应出勤天数;第二部份介绍当月有法定假期和调休的情况下计算应出勤天数。一、计算正常双休制的应出勤天数如下图所示,要求计算各员工2021年3月...

《Excel一键生成工作日历:让会议排期更轻松!》

每当需要安排会议时,总要翻看日历确认工作日,再逐个标注会议时间,既耗时又容易出错。今天教大家用Excel快速生成工作日历表,让会议排期变得简单高效!一、快速生成日历框架创建基础日期:在A1单元格输入月...

如何计算指定日期区间内,有多少工作日和休息日?

大家好,今天咱们要解决的问题是如何计算给定的一段日期内,正常工作日有多少天,放假时间有多少天?比如咱们要计算2025年3月份工作日一共有多少天,又有多少天放假,如下图所示:通过肉眼我们可以数清楚,20...

如何如何在表格中自动突出显示双休日?

现在不少人喜欢用Excel来制作备忘录或安排工作事项。在表格中输入日期后,可以使用条件格式突出显示双休日,避免在休息日安排了工作。具体方法是这样的:第1步:选择要设置条件格式的日期单元格区域;在“开始...

excel函数技巧:networkdays.intl判断节假日

如图,想知道6月的每一天是否是节假日,公式如下:=NETWORKDAYS.INTL(A2,A2,1,$E$2:$E$28)这个函数既可以判断当前日期(一参=二参)是否是周末及工作日(三参、四参)还可得...

仅需3步,让考勤表根据实际休息日,自动地填充颜色

Hello,大家好,之前跟大家分享了我们如何让考勤表根据单休与双休自动的填充颜色,最近有粉丝问到:能不能让考勤表根据实际的休息日自动的填充颜色呢?可以是可以,只不过因为牵扯到假期调休,我们每年的休息日...

5步搞定动态考勤表!标记节假日、调休日?Excel自动变色!

今天教你用「动态考勤表」一招解决所有问题!只需输入月份,自动变色、自动更新节假日,从此告别加班,效率翻倍!动态考勤表的优势:自动变色:节假日、双休日一键标记,颜色分明。一表多用:修改月份即可...

一起用python做个炫酷音乐播放器,想听啥随便搜

前言前段时间写的Python自制一款炫酷音乐播放器,有不少小伙伴私信我,对播放器提了不少改进建议,让我完善播放器的功能。今天音乐播放器2.0版本完成了,大家一起来看看是如何用python自制一款炫酷的...

用Python做个“冰墩墩雪容融”桌面部件(好玩又有趣)

桌面太单调?今天就带大家,一起用Python的PyQt5开发一个有趣的自定义桌面动画挂件,看看实现的动画挂件效果!下面,我们开始介绍这个自定义桌面动画挂件的制作过程。一、核心功能设计实现将动态图gif...

Python串口调试助手源码分享

以下是一个基于Python和PyQt5实现的串口调试助手示例,包含核心功能实现代码:pythonimportsysimportserialfromPyQt5.QtCoreimportQTim...