awk命令「建议收藏」

awk命令

大家好,又见面了,我是全栈君。

1.awk工作流程


a)先运行BEGIN。
b)读取文件。读入有/n换行符切割的一条记录
c)将记录按指定的域分隔符进行划分域
d)填充域,当中$0表示全部域。$1表示第一个域,$n表示第那个域(默认域分隔符是空白键或者tab键)
e)開始运行模式所相应的动作action
f)接着開始读入第二条记录,直到全部的记录都被读完
g)运行END操作

2.用法


awk [-F field-separator] ‘{pattern + action}’ {filenames}
1. pattern表示awk在数据中查找的内容,action表示在找到匹配内容时所运行的一系列命令。

action{}能够有多个语句,以”;”号隔开。

2. [-F域分隔符]是可选的。 filenames是待处理的文件。在awk中,文件的每一行中,由域分隔符分开的每一项称为一个域。通常,在不指名-F域分隔符的情况下。默认的域分隔符是空格。

3.awk内置变量


ARGC
命令行參数个数
ARGV
命令行參数排列
ENVIRON
支持队列中系统环境变量的使用
FILENAME
awk浏览的文件名称
FNR
浏览文件的记录数
FS
设置输入域分隔符,等价于命令行 -F选项
NF
浏览记录的域的个数
NR
已读的记录数
OFS
输出域分隔符
ORS
输出记录分隔符
RS
控制记录分隔符

某个文件从第n行到行尾
awk ‘{NR > n}’ filename

4.awk内置字符串函数


gsub(r,s)
在整个$0中用s替代r

gsub(r,s,t)
在整个t中用s替代r

index(s,t)
返回s中字符串t的第一位置

length(s)
返回s长度

match(s,r)
測试s是否包括匹配r的字符串

split(str,array,fs )
在fs上将s分成序列a

sprint(fmt,exp)
返回经fmt格式化后的exp

sub(r,s)
用$0中最左边最长的子串取代s

substr(s,p)    
返回字符串s中从p開始的后缀部分

substr(s,p,n)  
返回字符串s中从p開始长度为n的后缀部分


5.BEGIN和END


BEGIN表示在处理随意行之前进行的操作
END表示在全部输入行处理完后进行的处理。


6.条件语句


if (expression) {
    statement;
    statement;
    ... ...
}

if (expression) {
    statement;
} else {
    statement2;
}

if (expression) {
    statement1;
} else if (expression1) {
    statement2;
} else {
    statement3;
}

7.数组


由于awk中数组的下标能够是数字和字母,数组的下标通常被称为keyword(key)。值和keyword都存储在内部的一张针对key/value应用hash的表格里。由于hash不是顺序存储,因此在显示数组内容时会发现。它们并非依照你预料的顺序显示出来的。数组和变量一样,都是在使用时自己主动创建的。awk也相同会自己主动推断其存储的是数字还是字符串。一般而言。awk中的数组用来从记录中收集信息,能够用于计算总和、统计单词以及跟踪模板被匹配的次数等等。

awk -F ':' 'BEGIN {count=0;} {name[count] = $1;count++;}; END{for (i = 0; i < NR; i++) print i, name[i]}' /etc/passwd
root
daemon
bin
sys
sync
games
......

awk -F’\t’ ‘{ a[$1]++ }’END'{ for(j in a) print a[j],j }’ filename | sort -rn | more 

filename的内容为:
apple
banana
apple
apple
banana
pear

输出结果为:
3 apple
2 banana
1 pear


版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请联系我们举报,一经查实,本站将立刻删除。

发布者:全栈程序员-站长,转载请注明出处:https://javaforall.net/116223.html原文链接:https://javaforall.net

(0)
全栈程序员-站长的头像全栈程序员-站长


相关推荐

  • JSP的Servlet与Tomcat

    JSP的Servlet与TomcatJSP的Servlet与Tomcat

    2022年4月22日
    38
  • 基于MATLAB语音信号的处理与滤波

    基于MATLAB语音信号的处理与滤波摘要:MATLAB是十分强大的用于数据分析和处理的工程实用软件,利用其来进行语音信号的分析、处理和可视化十分便捷。文中介绍了在MATLAB环境中如何驱动声卡采集语音信号和语音信号采集后的文档处理方法,并介绍了FFT频谱分析原理及其显示、MATLAB中相关函数的功能、滤波器的设计和使用。在此基础上,对实际采集的一段含噪声语音信号进行了相关分析处理,包括对语音信号的录取和导入,信号时域和频域方面的分析,添加噪声前后的差异对比,滤波分析,语音特效处理。结果表明利用MATLAB处理语音信号十分简单、方便且易于实现。

    2022年5月25日
    49
  • strtok()函数详解!

    strtok()函数详解!strtok()函数详解!1.定义分解字符串为一组字符串。s为要分解的字符,delim为分隔符字符(如果传入字符串,则传入的字符串中每个字符均为分割符)。首次调用时,s指向要分解的字符串,之后再次调用要把s设成NULL。在头文件#include&lt;string.h&gt;中。2.原型char*strtok(chars[],constchar*delim);3.说明(1)当…

    2022年7月14日
    10
  • 基于AX88796B的网络接口模块的设计与实现[通俗易懂]

    基于AX88796B的网络接口模块的设计与实现[通俗易懂] 基于AX88796B的网络接口模块的设计与实现[日期:2008-7-22]来源:今日电子/21IC 作者:重庆邮电大学崔巍[字体:大中小]  引言网络技术应用日益普及的今天,工业现场的仪器仪表、数据采集和控制设备也日趋网络化,工业自动化和网络的结合越来越密切。而将以太网和嵌入式系统相结合应用于工业控制中已成为趋势。AX8

    2022年6月10日
    30
  • redis 的两种持久化方式及原理[通俗易懂]

    redis 的两种持久化方式及原理[通俗易懂]redis 的两种持久化方式及原理

    2022年4月23日
    53
  • H3C交换机常用配置命令大全

    H3C交换机常用配置命令大全H3C交换机常用配置命令大全一.用户配置:&lt;H3C&gt;system-view[H3C]superpasswordH3C设置用户分级密码[H3C]undosuperpassword删除用户分级密码[H3C]localuserbigheap1234561Web网管用户设置,1(缺省)为管理级用户…

    2022年6月20日
    32

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

关注全栈程序员社区公众号