awk命令的使用

本文介绍了awk命令的基本用法,包括如何在awk中使用shell变量以及如何从awk向shell传递变量。此外,还深入讲解了awk中Extended Regular Expression (ERE) 的基础表达式符号,帮助读者掌握awk命令在文本处理中的应用。

awk命令教程


awk命令参考


awk 使用shell的变量

方法是:awk -v 选项让awk 里使用shell变量 
TIME=60 
awk -v time="$TIME" 'BEGIN{FS="|"} {if ($7>time) print $2 }' 
这样要注意:在awk里,time不能加$符号


shell 使用 awk变量

由awk向shell传递变量”,其思想无非是用awk(sed/perl等也是一样)输出若干条shell命令,然后再用shell去执行这些命令。


eval $(awk ‘BEGIN{print “var1=’str1′;var2=’str2′”}’)


或者eval $(awk ‘{printf(“var1=%s; var2=%s; var3=%s;”,$1,$2,$3)}’ abc.txt)


之后可以在当前shell中使用var1,var2等变量了。


echo “var1=$var1 —– var2=$var2”


一、awk Extended Regular Expression (ERES)基础表达式符号介绍

字符功能
+指定如果一个或多个字符或扩展正则表达式的具体值(在 +(加号)前)在这个字符串中,则字符串匹配。命令行:

awk '/smith+ern/' testfile

将包含字符 smit,后跟一个或多个 h 字符,并以字符 ern 结束的字符串的任何记录打印至标准输出。此示例中的输出是:

smithern, harry smithhern, anne

?指定如果零个或一个字符或扩展正则表达式的具体值(在 ?(问号)之前)在字符串中,则字符串匹配。命令行:

awk '/smith?/' testfile

将包含字符 smit,后跟零个或一个 h 字符的实例的所有记录打印至标准输出。此示例中的输出是:

smith, alan smithern, harry smithhern, anne smitters, alexis

|指定如果以 |(垂直线)隔开的字符串的任何一个在字符串中,则字符串匹配。命令行:

awk '/allen | alan /' testfile

将包含字符串 allenalan 的所有记录打印至标准输出。此示例中的输出是:

smiley, allen smith, alan

( )在正则表达式中将字符串组合在一起。命令行:

awk '/a(ll)?(nn)?e/' testfile

将具有字符串 aealleanneallnne 的所有记录打印至标准输出。此示例中的输出是:

smiley, allen smithhern, anne

{m}指定如果正好有 m 个模式的具体值位于字符串中,则字符串匹配。命令行:

awk '/l{2}/' testfile

打印至标准输出

smiley, allen

{m,}指定如果至少 m 个模式的具体值在字符串中,则字符串匹配。命令行:

awk '/t{2,}/' testfile

打印至标准输出:

smitters, alexis

{m, n}指定如果 mn 之间(包含的 m 和 n)个模式的具体值在字符串中(其中m <=n),则字符串匹配。命令行:

awk '/er{1, 2}/' testfile

打印至标准输出:

smithern, harry smithern, anne smitters, alexis

[String]指定正则表达式与方括号内 String 变量指定的任何字符匹配。命令行:

awk '/sm[a-h]/' testfile

将具有 sm 后跟以字母顺序从 ah 排列的任何字符的所有记录打印至标准输出。此示例的输出是:

smawley, andy

[^ String]在 [ ](方括号)和在指定字符串开头的 ^ (插入记号) 指明正则表达式与方括号内的任何字符匹配。这样,命令行:

awk '/sm[^a-h]/' testfile

打印至标准输出:

smiley, allen smith, alan smithern, harry smithhern, anne smitters, alexis

~,!~表示指定变量与正则表达式匹配(代字号)或不匹配(代字号、感叹号)的条件语句。命令行:

awk '$1 ~ /n/' testfile

将第一个字段包含字符 n 的所有记录打印至标准输出。此示例中的输出是:

smithern, harry smithhern, anne

^指定字段或记录的开头。命令行:

awk '$2 ~ /^h/' testfile

将把字符 h 作为第二个字段的第一个字符的所有记录打印至标准输出。此示例中的输出是:

smithern, harry

$指定字段或记录的末尾。命令行:

awk '$2 ~ /y$/' testfile

将把字符 y 作为第二个字段的最后一个字符的所有记录打印至标准输出。此示例中的输出是:

smawley, andy smithern, harry

. (句号)表示除了在空白末尾的终端换行字符以外的任何一个字符。命令行:

awk '/a..e/' testfile

将具有以两个字符隔开的字符 a 和 e 的所有记录打印至标准输出。此示例中的输出是:

smawley, andy smiley, allen smithhern, anne

*(星号)表示零个或更多的任意字符。命令行:

awk '/a.*e/' testfile

将具有以零个或更多字符隔开的字符 a 和 e 的所有记录打印至标准输出。此示例中的输出是:

smawley, andy smiley, allen smithhern, anne smitters, alexis

\ (反斜杠)转义字符。当位于在扩展正则表达式中具有特殊含义的任何字符之前时,转义字符除去该字符的任何特殊含义。例如,命令行:

/a\/\//

将与模式 a // 匹配,因为反斜杠否定斜杠作为正则表达式定界符的通常含义。要将反斜杠本身指定为字符,则使用双反斜杠。有关反斜杠及其使用的更多信息,请参阅以下关于转义序列的内容。

 

与PERs相比,主要是一些结合类型表示符没有了:包括:”\d,\D,\s,\S,\t,\v,\n,\f,\r”其它功能基本一样的。 我们常见的软件:javascript,.net,java支持的正则表达式,基本上是:EPRs类型。

 

二、awk 常见调用正则表达式方法

  • awk语句中:

awk ‘/REG/{action}’

/REG/为正则表达式,可以将$0中,满足条件记录 送入到:action进行处理.

  • awk正则运算语句(~,~!等同!~)

[chengmo@centos5 ~]$ awk 'BEGIN{info="this is a test";if( info ~ /test/){print "ok"}}'
ok

  • awk内置使用正则表达式函数

gsub( Ere, Repl, [ In ] )

sub( Ere, Repl, [ In ] )

match( String, Ere )

split( String, A, [Ere] )

详细函数使用,可以参照:linux awk 内置函数详细介绍(实例)


<think>嗯,用户想了解awk命令使用方法、语法和示例。首先我需要回忆一下之前提供的引用内容,看看有哪些相关的信息可以整合。引用[2]提到awk是一个强大的编程工具,支持自定义函数和正则表达式,通常在Linux/Unix下使用。用户需要教程类的信息,所以结构要清晰,分步骤讲解。 用户可能刚接触awk,所以需要从基础开始。根据引用[4],awk的基本结构是pattern加上action,所以首先应该解释基本命令格式,比如`awk 'pattern {action}' filename`。然后,可能需要分点说明不同部分的作用,比如pattern用于匹配条件,action是执行的操作。 接下来,用户可能需要具体的示例。比如,显示整行的例子,引用[4]里提到`awk '{print}' filename`,这个可以作为第一个例子。另外,引用[1]中有输出第1和第4列的示例,可以演示字段分割。还要提到默认分割符是空格或TAB,用户可能需要知道如何指定其他分隔符,比如-F选项,这在引用[3]的示例里有用到。 然后,关于条件筛选,比如匹配包含特定字符串的行,引用[3]中的例子有使用if语句,但可能需要更简单的例子,比如`awk '/root/ {print}' /etc/passwd`。同时,内置变量如NR、NF需要解释,比如NR是行号,NF是字段数,这在处理数据时很有用。 用户可能还想了解更复杂的操作,比如计算和统计。比如统计文件行数,可以使用END关键字,引用[3]中有类似的例子。另外,BEGIN块的作用也需要提到,比如初始化操作。 流程控制方面,for循环的使用,引用[3]中的例子可以展示如何遍历字段。还有自定义变量,比如累加数值,这在实际处理数据时常见。 最后,提供常见应用场景,比如日志分析、数据提取等,结合用户可能的需求。同时,确保所有示例符合语法,比如单引号的使用,避免用户复制时出错。还要注意生成相关问题,帮助用户进一步学习,比如如何修改分隔符或处理多文件。 需要检查是否有遗漏的部分,比如命令行参数、高级功能如自定义函数,但根据引用内容,可能不需要深入,保持基础即可。确保回答结构清晰,分点明确,示例正确,符合用户的实际需求。</think>### AWK命令使用教程(语法+示例) #### 一、基本语法结构 AWK命令的通用格式为: $$ awk 'pattern { action }' filename $$ - `pattern`:匹配条件(可省略) - `action`:执行的操作(必须用`{}`包裹) - `filename`:要处理的文件(可从管道输入) #### 二、核心功能演示 1. **字段分割与输出** - 默认按空格/TAB分割字段,`$1`表示第1列,`$0`表示整行 ```bash awk '{print $1,$4}' log.txt # 输出每行第1和第4列 awk -F: '{print $3}' /etc/passwd # 使用冒号分割字段[^3] ``` 2. **条件筛选** ```bash awk '/test/ {print}' log.txt # 输出包含"test"的行[^4] awk '$3 > 5 {print $0}' data.txt # 第3列大于5时输出整行 ``` 3. **内置变量** - `NR`:当前行号 - `NF`:当前行的字段总数 ```bash awk '{print NR,NF,$0}' log.txt # 显示行号、字段数和整行 ``` #### 三、进阶用法 1. **BEGIN/END块** ```bash awk 'BEGIN{sum=0} {sum+=$1} END{print sum}' data.txt # 计算第1列总和[^3] ``` 2. **流程控制** ```bash awk '{for(i=1;i<=NF;i++) if($i=="apple") print $0}' log.txt # 遍历字段找"apple"[^3] ``` 3. **自定义变量** ```bash awk -v rate=0.8 '{print $1*rate}' price.txt # 使用外部变量计算折扣价[^2] ``` #### 四、常见应用场景 1. **日志分析**:提取特定时间段的日志 2. **数据清洗**:过滤异常值或格式化输出 3. **统计计算**:求和/平均值/最大值等[^1]
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
红包 添加红包
表情包 插入表情
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值