AWK

报告生成器,格式化文本输出,常用选项:

  • -F:指明输入时用到的字段分隔符
  • -v var=value:自定义变量

介绍

基本格式:

awk [options] ‘program’ var=value file…
awk [options] -f programfile var=value file…
awk [options] 'BEGIN{ action;… } pattern{ action;… } END{ action;… }' file ...

program:pattern{action statements;..}

pattern部分决定动作语句何时触发及触发事件
action statements对数据进行处理,放在{}内指明

awk执行时,由分隔符分隔的字段(域)标记1,2..n称为域标识。0为所有域,注意:和shell中变量$符含义不同

文件的每一行称为记录。省略action,则默认执行 print $0 的操作

工作原理

  1. 执行BEGIN{action;… }语句块中的语句
  2. 从文件或标准输入(stdin)读取一行,然后执行pattern{ action;… }语句块,它逐行扫描文件,从第一行到最后一行重复这个过程,直到文件全部被读取完毕
  3. 当读至输入流末尾时,执行END{action;…}语句块

BEGIN语句块在awk开始从输入流中读取行之前被执行,这是一个可选的语句块,比如变量初始化、打印输出表格的表头等语句通常可以写在BEGIN语句块中

END语句块在awk从输入流中读取完所有的行之后即被执行,比如打印所有行的分析结果这类信息汇总都是在END语句块中完成,它也是一个可选语句块

pattern语句块中的通用命令是最重要的部分,也是可选的。如果没有提供pattern语句块,则默认执行{ print },即打印每一个读取到的行,awk读取的每一行都会执行该语句块

print

格式:print item1, item2, ...

要点:

  1. 逗号分隔符
  2. 输出的各item可以字符串,也可以是数值;当前记录的字段、变量或awk的表达式
  3. 如省略item,相当于print $0

示例:

  1. awk –F: '{print}' /etc/passwd:以冒号为分隔符,打印每行
  2. awk –F: ‘{print “root”}’ /etc/passwd:以冒号为分隔符,每行都打印root
  3. awk –F: ‘{print $1}’ /etc/passwd:以冒号为分隔符,打印每行的第一个字段
  4. awk –F: ‘{print $0}’ /etc/passwd:等同于awk –F: '{print}' /etc/passwd
  5. awk –F: ‘{print 1”\t”3}’ /etc/passwd:以冒号为分隔符,打印每行的1、3字段,\t表示tab,默认时空格
  6. tail –3 /etc/fstab |awk ‘{print 2,4}’:取/etc/fstab文件末尾3行,默认以空格为分隔符(连续的空格,tab都算空格),打印每行2、4字段

变量

引用内置变量和自定义变量都需要加$

内置变量

默认字段分隔符为空格,默认记录分隔符为回车

FS:输入字段分隔符,默认为空白字符

OFS:输出字段分隔符,默认为空白字符

RS:输入记录分隔符,指定输入时的换行符

ORS:输出记录分隔符,输出时用指定符号代替换行符

NF:字段数量

NR:记录号,多文件一起记录

FNR:各文件分别计数,记录号

FILENAME:当前文件名

ARGC:命令行参数的个数

ARGV:数组,保存的是命令行所给定的各参数

示例:

  1. awk -v FS=':' '{print 1,FS,3}’ /etc/passwd:以冒号为输入字段分隔符,打印1、:、3字段
  2. awk -v FS=‘:’ -v OFS=‘----’ '{print 1,3,$7}’ /etc/passwd:以冒号为输入字段分隔符,以----为输出字段分隔符,打印1、3、7字段
  3. awk -v RS=' ' ‘{print }’ /etc/passwd:以空格为输入记录分隔符,碰到空格就换行,打印每行
  4. awk -v RS=' ' -v ORS='###'‘{print }’ /etc/passwd:以空格为输入记录分隔符,以###为输出记录分隔符,打印每行
  5. awk -F: ‘{print NF}’ /etc/fstab:以冒号为字段分隔符,打印每行被冒号分割成的字段数
  6. awk -F: '{print $(NF-1)}' /etc/passwd
  7. awk '{print NR}' /etc/fstab:打印记录号
  8. awk END'{print NR}' /etc/fstab:结束时打印记录号
  9. awk '{print FNR}' /etc/fstab /etc/inittab:分别打印两个文件的记录号,独立计数
  10. awk '{print FILENAME}’ /etc/fstab:每行都打印当前文件名
  11. awk '{print ARGC}’ /etc/fstab /etc/inittab:每行都打印当前命令行的参数个数
  12. awk ‘BEGIN {print ARGC}’ /etc/fstab /etc/inittab:开始打印当前命令行的参数个数
  13. awk ‘BEGIN {print ARGV[0]}’ /etc/fstab /etc/inittab:开始打印命令行所给定的第一个参数

自定义变量

定义方式:

-v var=value
在program中直接定义

示例:

  1. awk -v test='hello gawk' '{print test}' /etc/fstab:定义变量test,每行都打印test变量的内容

  2. awk -v test='hello gawk' 'BEGIN{print test}':定义变量test,开始打印test变量的内容

  3. awk 'BEGIN{test="hello,gawk";print test}':在program中定义变量test,开始i打印test变量的内容

  4. awk –F:‘{sex=“male”;print $1,sex,age;age=18}’ /etc/passwd:首行未打印age是因为起初age变量未定义

    [root@centos6 ~]# awk -F: '{sex="male";print $1,sex,age;age=18}' /etc/passwd
    root male 
    bin male 18
    ......
    tcpdump male 18
    

p'rintf

格式化输出:printf “FORMAT”, item1, item2, ...

  1. 必须指定FORMAT
  2. 不会自动换行,需要显式给出换行控制符,\n
  3. FORMAT中需要分别为后面每个item指定格式符

格式符:

%c:显示字符的ASCII码
%d, %i:显示十进制整数
%e, %E:显示科学计数法数值
%f:显示为浮点数
%g, %G:以科学计数法或浮点形式显示数值
%s:显示字符串
%u:无符号整数
%%:显示%自身

修饰符:

[.#]:第一个数字控制显示的宽度;第二个#表示小数点后精度,%3.1f

-: 左对齐(默认右对齐) %-15s
+:显示数值的正负符号 %+d

示例:

  1. awk -F: ‘{printf "%s",$1}’ /etc/passwd
  2. awk -F: ‘{printf "%s\n",$1}’ /etc/passwd
  3. awk -F: '{printf "%-20s %10d\n",1,3}' /etc/passwd
  4. awk -F: ‘{printf "Username: %s\n",$1}’ /etc/passwd
  5. awk -F: ‘{printf “Username: %s,UID:%d\n",1,3}’ /etc/passwd
  6. awk -F: ‘{printf "Username: %15s,UID:%d\n",1,3}’ /etc/passwd
  7. awk -F: ‘{printf "Username: %15s,UID:%d\n",1,3}’ /etc/passwd

操作符

算术操作符:+、-、*、/、^、%

赋值操作符:=、+=、-=、*=、/=、%=、^=、++、--

[root@centos6 ~]# awk 'BEGIN{i=0;print ++i,i}'
1 1
[root@centos6 ~]# awk 'BEGIN{i=0;print i++,i}'
0 1

比较操作符:==、!=、>、>=、<、<=

模式匹配符:~、!~

示例:

  1. awk –F: '0 ~ /root/{print1}‘ /etc/passwd
  2. awk '$0 ~“^root"' /etc/passwd
  3. awk '$0 !~ /root/‘ /etc/passwd
  4. awk –F: ‘$3==0’ /etc/passwd

逻辑操作符:&&、||、!

示例:

  1. awk -F: '3>=0 &&3<=1000{print $1}' /etc/passwd
  2. awk -F: '3==0 ||3>=1000 {print $1}' /etc/passwd
  3. awk -F: ‘!(3==0) {print1}' /etc/passwd
  4. awk -F: ‘!(3>=500) {print3}’ /etc/passwd

条件表达式(三目表达式):selector?if-true-expression:if-false-expression

示例:

awk -F: '{3>=1000?usertype="Common User":usertype="Sysadmin or SysUser";printf "%15s:%-s\n",1,usertype}' /etc/passwd

awk PATTERN

根据pattern条件,过滤普配的行,再做处理

  1. 如果未指定::空模式,匹配每一行
  2. /regular expression/:正则匹配,仅处理能够模式匹配到的行,需要用/ /括起来
  3. relational expression:关系表达式,结果为“真”才会被处理(真:结果为非0值,非空字符串、假:结果为空字符串或0值)
  4. /pat1/,/pat2/
  5. BEGIN/END模式

示例:

  1. awk -F: 'i=1;j=1{print i,j}' /etc/passwd
  2. awk '!0' /etc/passwd ; awk '!1' /etc/passwd
  3. awk -F: '3>=1000{print1,$3}' /etc/passwd
  4. awk -F: '3<1000{print1,$3}' /etc/passwd
  5. awk -F: 'NF=="/bin/bash"{print1,$NF}' /etc/passwd
  6. awk -F: 'NF~"bash"{print1,$NF}' /etc/passwd
  7. awk -F: '/^root\>/,/^nobody\>/{print $1}' /etc/passwd:\>锚定单词词尾
  8. awk -F: 'NR>=10 && NR<=20{print NR,$1}' /etc/passwd
  9. awk -F: 'BEGIN{print "USER USERID"}{print 1":"3}END{print "end file"}' /etc/passwd
  10. awk -F: '{print "USER USERID";print 1":"3}END{print "end file"}' /etc/passwd
  11. awk -F: 'BEGIN{print " USER UID \n--------------- "}{print 1,3}' /etc/passwd
  12. awk -F: 'BEGIN{print " USER UID \n--------------- "}{print 1,3}END{print "=============="}' /etc/passwd
  13. seq 10 | awk 'i=0':0表示假,不执行操作
  14. seq 10 | awk 'i=1':1表示真,执行默认操作,打印全行
  15. seq 10 | awk 'i=!i':打印奇数行
  16. seq 10 | awk '{i=!i;print i}'
  17. seq 10 | awk '!(i=!i)':打印偶数行
  18. seq 10 | awk -v i=1 'i=!i':打印偶数行

awk action

if-else

if(condition1){statement1}else if(condition2){statement2}else{statement3}

示例:

  1. awk -F: '{if(3>=1000)print1,$3}' /etc/passwd
  2. awk -F: '{if(NF=="/bin/bash")print1}' /etc/passwd
  3. awk '{if(NF>5)print $0}' /etc/fstab
  4. awk -F: '{if(3>=1000) {printf "Common user: %s\n",1} else {printf "root or Sysuser: %s\n",$1}}' /etc/passwd
  5. awk -F: '{if(3>=1000) printf "Common user: %s\n",1; else printf "root or Sysuser: %s\n",$1}' /etc/passwd
  6. df -h|awk -F% '/^/dev/{print 1}'|awk 'NF>=80{print 1,5}’
  7. awk 'BEGIN{ test=100;if(test>90){print "very good"}else if(test>60){ print "good"}else{print "no pass"}}'

while

while(condition1){statement1}

对一行内的多个字段逐一类似处理时使用,对数组中的各元素逐一处理时使用

示例:

  1. awk '/^[[:space:]]*linux16/{i=1;while(i<=NF){print i,length(i);i++}}' /etc/grub2.cfg
  2. awk '/^[[:space:]]*linux16/{i=1;while(i<=NF){if(length(i)>=10){printi,length($i)}; i++}}' /etc/grub2.cfg

do-while

do {statement;…}while(condition)

无论真假,至少执行一次循环体,尾部判断

示例:

  1. awk 'BEGIN{total=0;i=0;do{total+=i;i++}while(i<=100);print total}':1+...+100总和

for

for(expr1;expr2;expr3) {statement;…}

特殊用法便利数组中的元素:for(var in array) {for-body}

示例:

  1. awk '/^[[:space:]]*linux16/{for(i=1;i<=NF;i++) {print i,length(i)}}' /etc/grub2.cfg

switch

switch(expression) {case VALUE1 or /REGEXP/: statement1; case VALUE2 or /REGEXP2/: statement2; ...; default: statementn}

break

和shell脚本中的break类似

awk 'BEGIN{sum=0;for(i=1;i<=100;i++){if(i==66)break;sum+=i}print sum}'

continue

和shell脚本中的continue类似

awk 'BEGIN{sum=0;for(i=1;i<=100;i++){if(i%2==0)continue;sum+=i}print sum}'

next

提前结束对本行处理而直接进入下一行处理(awk自身循环

awk -F: '{if(3%2!=0)next;print1,$3}' /etc/passwd

数组

index-expression:

可使用任意字符串;字符串要使用双引号括起来

如果某数组元素事先不存在,在引用时,awk会自动创建此元素,并将其值初始化为“空串”

数组遍历:

若要遍历数组中的每个元素,要使用for循环

for(var in array) {for-body}

注意:var会遍历array的每个索引

示例:

  1. awk 'BEGIN{weekdays["mon"]="monday";weekdays["tue"]="tuesday";print weekdays["mon"]}'
  2. awk '!arr[$0]++' test.txt:去重复行
  3. awk '{!arr[0]++;print0, arr[$0]}' dupfile
  4. awk 'BEGIN{weekdays["mon"]="monday";weekdays["tue"]="tuesday";for(i in weekdays){print weekdays[i]}}'
  5. netstat -tan|awk '/^tcp/{state[$NF]++}END{for(i in state){print i,state[i]}}':取tcp各监听状态数量
  6. awk '{ip[$1]++}END{for(i in ip) {print i,ip[i]}}' /var/log/httpd/access_log

函数

srand():置随机数种子
rand():返回0和1之间一个随机数

length([s]):返回指定字符串的长度

sub(r,s,[t]):对t字符串进行搜索r表示的模式匹配的内容,并将第一个匹配的内容替换为s
gsub(r,s,[t]):对t字符串进行搜索r表示的模式匹配的内容,并全部替换为s所表示的内容

split(s,array,[r]):以r为分隔符,切割字符串s,并将切割后的结果保存至array所表示的数组中,第一个索引值为1,第二个索引值为2,…

自定义函数:
function name ( parameter, parameter, ... ) {
statements
return expression
}

示例:

  1. awk 'BEGIN{srand();for(i=1;i<=10;i++)print int(rand()*100)}'
  2. echo "2008:08:08 08:08:08" | awk 'sub(/:/,"-",$1)'
  3. echo "2008:08:08 08:08:08" | awk 'gsub(/:/,"-",$0)'
  4. netstat -tan|awk '/^tcp>/{split($5,ip,":");count[ip[1]]++}END{for(i in count){print i,count[i]}}':查看tcp各ip连接数量

system调用shell命令

空格是awk中的字符串连接符,如果system中需要使用awk中的变量可以使用空格分隔,或者说除了awk的变量外其他一律用""引用起来

示例:

  1. awk 'BEGIN{system("hostname")}'
  2. awk 'BEGIN{score=100;system("echo your score is " score)}'

awk脚本

将awk程序写成脚本,直接调用或执行

[root@centos6 app]# cat fi.awk 
{if($3>=1000){print $1,$3}}
[root@centos6 app]# awk -F: -f fi.awk /etc/passwd
nfsnobody 65534

[root@centos6 app]# cat f2.awk 
#!/bin/awk -f
{if($3>=1000){print $1,$3}}
[root@centos6 app]# chmod +x f2.awk 
[root@centos6 app]# ./f2.awk -F: /etc/passwd
nfsnobody 65534

向awk脚本传递参数

awkfile var=value var2=value2... Inputfile

[root@centos6 app]# cat test.awk 
#!/bin/awk -f
{if($3>=min && $3<=max){print $1,$3}}
[root@centos6 app]# chmod +x test.awk 
[root@centos6 app]# ./test.awk -F: min=100 max=200 /etc/passwd
usbmuxd 113
avahi-autoipd 170
abrt 173

[root@centos6 app]# awk -F: -v min=100 -v max=200 '{if($3>=min && $3<=max){print $1,$3}}' /etc/passwd
usbmuxd 113
avahi-autoipd 170
abrt 173

练习

  1. 统计/etc/fstab文件中每个文件系统类型出现的次数

    [root@centos6 app]# awk '/^UUID/{type[$3]++}END{for(i in type){print i,type[i]}}' /etc/fstab 
    swap 1
    ext4 3
    
  2. 统计/etc/fstab文件中每个单词出现的次数

    [root@centos6 app]# awk '{for(i=0;i<NF;i++){$(NF-i) ~ /\<[[:alpha:]]+\>/ && count[$(NF-i)]++}}END{for(i in count){print i,count[i]}}' /etc/fstab
    
  3. 提取出字符串Yd$C@M05MB%9&Bdh7dq+YVixp3vpw中的所有数字

    [root@centos6 app]# echo "Yd$C@M05MB%9&Bdh7dq+YVixp3vpw"|awk -F '' '{for(i=1;i<=NF;i++){if($i ~ /[[:digit:]]/)printf $i}}'
    05973[root@centos6 app]#
    
  4. 解决DOS攻击生产案例:根据web日志或者或者网络连接数,监控当某个IP并发连接数或者短时内PV达到100,即调用防火墙命令封掉对应的IP,监控频率每隔5分钟。防火墙命令为:iptables -A INPUT -s IP -j REJECT

    
    
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 206,378评论 6 481
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 88,356评论 2 382
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 152,702评论 0 342
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 55,259评论 1 279
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 64,263评论 5 371
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 49,036评论 1 285
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 38,349评论 3 400
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 36,979评论 0 259
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 43,469评论 1 300
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 35,938评论 2 323
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 38,059评论 1 333
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 33,703评论 4 323
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 39,257评论 3 307
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 30,262评论 0 19
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 31,485评论 1 262
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 45,501评论 2 354
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 42,792评论 2 345

推荐阅读更多精彩内容

  • awk介绍awk变量printf命令:实现格式化输出操作符awk patternawk actionawk数组aw...
    哈喽别样阅读 1,549评论 0 4
  • awk:报告生成器,格式化文本输出 内容: awk介绍 awk基本用法 awk变量 awk格式化 awk操作符 a...
    BossHuang阅读 1,452评论 0 9
  • 本章主要学习内容awk介绍 awk基本用法 awk变量 awk格式化 awk操作符 awk条件判断 a...
    楠人帮阅读 1,254评论 0 8
  • '#Gun awk的相关用法 awk的工作原理 一次读取一行文本,按输入分隔符进行切片,切成多个组成部分,将每片直...
    魏镇坪阅读 39,679评论 2 37
  • CFDictionaryRef exifAttachments = CMGetAttachment(sampleB...
    流年易逝_李阅读 342评论 0 0