正则表达式中的预查匹配

  正则表达式中的(?=)和(?!)可以用于非捕获(非消耗)地预查匹配,但这个功能往往被人们所忽略。其实在实际使用中还是很有用的。
  最近用PHP做一个功能,实现网页中关键字文本到关键字链接的替换,但时常会出现一些错误的替换。有一个常见的错误是在链接中的文本被重复替换,所以要在替换时判断该文本是否已经一个链接中。一个简单的想法就是看文本后面不能出现“</a>”,当然中间也不能出现“<a”。正则表达式很少有非的逻辑,如果用[^]来限定,又只能限定一个字符。所以我们可以使用(?!)来进行这个逻辑:

key( ?! ( ?! . *?< a). *?< \ / a > )

注意应该用非贪婪匹配.*?来查找其中出现的任意其它字符。这样的正则表达式对大部分情况已经可以适用了,除非是一个嵌套的链接,该表达式就会误匹配:
<a>key<a>anything</a></a>
因为正则表达式很难往前匹配,而且在网页中出现这种代码也是错误的。所以可以不考虑这种情况。
  当然,这只是抛砖引玉罢了,肯定会有更好的方法可以解决此类问题,欢迎大家多提意见!

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值