找到含有某些字符的单词

【问题】

geeks, if I wanted to search a file for words that contained only the letters in a set, what would be my best regex? 

【回答】

       这个问题没什么好办法但也没什么难的,基本的解决思路是将文本拆成单词,单词再拆成字符集合,用计算交集来匹配字符。正则表达式理论上可以实现字符匹配,但涉及到次序不固定的情况下并不好写,而且执行速度较慢,还不如自己编程序实现上面的思路。下面用SPL来演绎一下:

A
1=file("e:\\sample.txt").read()
2=A1.words()
3=A2.select(["c","d","b"]==["c","d","b"]^~.split())

A1:读取文本

A2:将字符串拆成单词组成的序列

A3:循环将每个单词拆分成字符集合,查询出含有字符c,d,b的单词

       SPL支持字符串的拆分(split),也支持集合运算(^表示交集),还支持过滤(select),实现字符匹配较容易,性能也不错。另外,SPL的函数regex也可以进行正则表达式匹配。

 

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值