awk正则匹配

扩展的正则表达式(Extended Regular Expression 又叫 ExtendedRegEx 简称 EREs)。 

一、awk Extended Regular Expression (ERES)基础表达式符号介绍

+指定如果一个或多个字符或扩展正则表达式的具体值(在 +(加号)前)在这个字符串中,则字符串匹配。命令行:

awk '/smith+ern/'testfile

将包含字符 smit,后跟一个或多个 h 字符,并以字符 ern 结束的字符串的任何记录打印至标准输出。此示例中的输出是:

smithern, harrysmithhern, anne

?指定如果零个或一个字符或扩展正则表达式的具体值(在 ?(问号)之前)在字符串中,则字符串匹配。命令行:

awk '/smith?/'testfile

将包含字符 smit,后跟零个或一个 h 字符的实例的所有记录打印至标准输出。此示例中的输出是:

smith, alansmithern, harry smithhern, anne smitters, alexis

|指定如果以 |(垂直线)隔开的字符串的任何一个在字符串中,则字符串匹配。命令行:

awk '/allen | alan/' testfile

将包含字符串 allen 或 alan 的所有记录打印至标准输出。此示例中的输出是:

smiley, allensmith, alan

( )在正则表达式中将字符串组合在一起。命令行:

awk'/a(ll)?(nn)?e/' testfile

将具有字符串 ae 或 alle 或 anne 或 allnne 的所有记录打印至标准输出。此示例中的输出是:

smiley, allensmithhern, anne

{m}指定如果正好有 m 个模式的具体值位于字符串中,则字符串匹配。命令行:

awk '/l{2}/'testfile

打印至标准输出

smiley, allen

{m,}指定如果至少 m 个模式的具体值在字符串中,则字符串匹配。命令行:

awk '/t{2,}/'testfile

打印至标准输出:

smitters, alexis

{m, n}指定如果 m 和 n 之间(包含的 m 和 n)个模式的具体值在字符串中(其中m<= n),则字符串匹配。命令行:

awk '/er{1, 2}/'testfile

打印至标准输出:

smithern, harrysmithern, anne smitters, alexis

[String]指定正则表达式与方括号内 String 变量指定的任何字符匹配。命令行:

awk '/sm[a-h]/'testfile

将具有 sm 后跟以字母顺序从 a 到 h 排列的任何字符的所有记录打印至标准输出。此示例的输出是:

smawley, andy

[^ String]在 [ ](方括号)和在指定字符串开头的 ^ (插入记号) 指明正则表达式与方括号内的任何字符不匹配。这样,命令行: awk '/sm[^a-h]/' testfile

打印至标准输出:

smiley, allensmith, alan smithern, harry smithhern, anne smitters, alexis

~,!~表示指定变量与正则表达式匹配(代字号)或不匹配(代字号、感叹号)的条件语句。命令行: awk '$1 ~ /n/' testfile

将第一个字段包含字符 n 的所有记录打印至标准输出。此示例中的输出是:

smithern, harrysmithhern, anne

^指定字段或记录的开头。命令行: awk '$2 ~ /^h/' testfile

将把字符 h 作为第二个字段的第一个字符的所有记录打印至标准输出。此示例中的输出是:

smithern, harry

$指定字段或记录的末尾。命令行: awk '$2 ~ /y$/' testfile

将把字符 y 作为第二个字段的最后一个字符的所有记录打印至标准输出。此示例中的输出是:smawley, andy smithern, harry

. (句号)表示除了在空白末尾的终端换行字符以外的任何一个字符。命令行:

awk '/a..e/'testfile

将具有以两个字符隔开的字符 a 和 e 的所有记录打印至标准输出。此示例中的输出是:

smawley, andysmiley, allen smithhern, anne

*(星号)表示零个或更多的任意字符。命令行: awk '/a.*e/'testfile

将具有以零个或更多字符隔开的字符 a 和 e 的所有记录打印至标准输出。此示例中的输出是:smawley, andy smiley, allen smithhern, anne smitters, alexis

\ (反斜杠)转义字符。当位于在扩展正则表达式中具有特殊含义的任何字符之前时,转义字符除去该字符的任何特殊含义。例如,命令行:

/a\/\//

将与模式 a // 匹配,因为反斜杠否定斜杠作为正则表达式定界符的通常含义。要将反斜杠本身指定为字符,则使用双反斜杠。有关反斜杠及其使用的更多信息,请参阅以下关于转义序列的内容。 

与PERs相比,主要是一些结合类型表示符没有了:包括:”\d,\D,\s,\S,\t,\v,\n,\f,\r”其它功能基本一样的。 我们常见的软件:javascript,.net,java支持的正则表达式,基本上是:EPRs类型。 

二、awk 常见调用正则表达式方法

awk语句中:

awk‘/REG/{action}’

/REG/为正则表达式,可以将$0中,满足条件记录 送入到:action进行处理.

awk正则运算语句(~,~!等同!~)

[chengmo@centos5~]$ awk 'BEGIN{info="this is a test";if( info ~ /test/){print"ok"}}'
ok

[chengmo@centos5~]$ awk 'BEGIN{info="this is a test";if( info ~ /[^0-9][^a-z]/){print"ok"}}'

awk内置使用正则表达式函数

gsub( Ere, Repl, [In ] )

sub( Ere, Repl, [In ] )

match( String, Ere)

split( String, A,[Ere] )

表-Awk的正则表达式元字符
元字符
^        在串首匹配
$        在串尾匹配
.        匹配单个任意字符
*        匹配零个或多个前导字符
+        匹配一个或多个前导字符
?       匹配零个或一个前导字符
[ABC]        匹配指定字符组(即A、B和C)中任一字符
[^ABC]        匹配任何一个不在指定字符组(即A、B和C)中的字符
[A-Z]        匹配A至Z之间的任一字符
A|B        匹配A或B
(AB)+        匹配一个或多个AB的组合,例如:AB、ABAB、ABABAB
\*        匹配星号本身
&        用于替代串中,代表查找串中匹配到的内容

  • 1
    点赞
  • 6
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
引用\[2\]:在awk中,可以使用正则表达式来匹配和处理文本。正则表达式可以用于模式匹配、替换和提取文本等操作。可以在awk命令中直接使用正则表达式,也可以将正则表达式写入一个文件中,然后通过-f选项加载该文件。使用正则表达式时,可以使用一些特殊字符和元字符来表示不同的模式。例如,使用"."表示匹配任意字符,使用"*"表示匹配前一个字符的零个或多个实例,使用"\[\]"表示匹配括号内的任意一个字符等等。通过结合正则表达式awk的其他功能,可以实现更加灵活和强大的文本处理操作。 问题:awk正则表达式能和-f选项一起使用吗? 回答: 是的,awk正则表达式可以和-f选项一起使用。通过-f选项加载一个包含正则表达式的文件,可以在awk命令中使用该文件中定义的正则表达式进行模式匹配、替换和提取文本等操作。这样可以使awk命令更加灵活和可维护。例如,可以将一组复杂的正则表达式写入一个文件,然后通过-f选项加载该文件,使得awk命令更加清晰和易于理解。 #### 引用[.reference_title] - *1* [正则表达式awk工具用法](https://blog.csdn.net/weixin_45409403/article/details/102545317)[target="_blank" data-report-click={"spm":"1018.2226.3001.9630","extra":{"utm_source":"vip_chatgpt_common_search_pc_result","utm_medium":"distribute.pc_search_result.none-task-cask-2~all~insert_cask~default-1-null.142^v91^insert_down28v1,239^v3^insert_chatgpt"}} ] [.reference_item] - *2* *3* [9.正则表达式--awk](https://blog.csdn.net/honey_wx/article/details/120297795)[target="_blank" data-report-click={"spm":"1018.2226.3001.9630","extra":{"utm_source":"vip_chatgpt_common_search_pc_result","utm_medium":"distribute.pc_search_result.none-task-cask-2~all~insert_cask~default-1-null.142^v91^insert_down28v1,239^v3^insert_chatgpt"}} ] [.reference_item] [ .reference_list ]

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值