正则表达式

最新推荐文章于 2024-08-03 05:56:08 发布

lightmare625

最新推荐文章于 2024-08-03 05:56:08 发布

阅读量119

点赞数

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_41042404/article/details/86764356

版权

=====C/C++===== 专栏收录该内容

41 篇文章

订阅专栏

什么是正则表达式

很可能你使用过Windows/Dos下用于文件查找的通配符(wildcard)，也就是*和?。如果你想查找某个目录下的所有的Word文档的话，你会搜索*.doc。在这里，*会被解释成任意的字符串。和通配符类似，正则表达式也是用来进行文本匹配的工具，只不过比起通配符，它能更精确地描述你的需求——当然，代价就是更复杂。

入门

假设你在一篇英文小说里查找hi，你可以使用正则表达式hi。通常，处理正则表达式的工具会提供一个忽略大小写的选项，如果选中了这个选项，它可以匹配hi,HI,Hi,hI这四种情况中的任意一种。

不幸的是，很多单词里包含hi这两个连续的字符，比如him,history,high等等。用hi来查找的话，这里边的hi也会被找出来。如果要精确地查找hi这个单词的话，我们应该使用\bhi\b。

\b是正则表达式规定的一个特殊代码（元字符，metacharacter），代表着单词的开头或结尾，也就是单词的分界处。虽然通常英文的单词是由空格，标点符号或者换行来分隔的，但是\b并不匹配这些单词分隔字符中的任何一个，它只匹配一个位置。

如果需要更精确的说法，\b匹配这样的位置：它的前一个字符和后一个字符不全是(一个是,一个不是或不存在)\w。

假如你要找的是hi后面不远处跟着一个Lucy，你应该用\bhi\b.*\bLucy\b。

.是另一个元字符，匹配除了换行符以外的任意字符。

*同样是元字符，不过它代表的不是字符，也不是位置，而是数量——它指定*前边的内容可以连续重复使用任意次，包括0次，以使整个表达式得到匹配。例如’aaa‘和’ab*ac*a'匹配。因此，.*连在一起就意味着任意数量的不包含换行的字符。现在\bhi\b.*\bLucy\b的意思就很明显了：先是一个单词hi,然后是任意个任意字符(但不能是换行)，最后是Lucy这个单词。

如果同时使用其它元字符，我们就能构造出功能更强大的正则表达式。比如下面这个例子：

0\d\d-\d\d\d\d\d\d\d\d匹配这样的字符串：以0开头，然后是两个数字，然后是一个连字号“-”，最后是8个数字(也就是中国的电话号码。当然，这个例子只能匹配区号为3位的情形)。

为了避免那么多烦人的重复，我们也可以这样写这个表达式：0\d{2}-\d{8}。这里\d后面的{2}({8})的意思是前面\d必须连续重复匹配2次(8次)。

参考：

1.正则表达式30分钟入门教程

2.正则表达式全解析+常用示例

博客等级

码龄7年

130
原创

775
点赞

3386
收藏

159
粉丝

关注

私信

分类专栏

最新评论

C++:cin、cin.getline()、getline()的用法
有故事的嘿嘿嘿: mystr = "\n"; getline(cin, mystr); 这里其实不够准确，mystr中存什么都无所谓。因为添加这行代码的原理是普通的cin遇到'\n'结束，但不会丢弃'\n'，而getline默认遇到‘\n’结束。因此需要处理cin残留的'\n'。getline遇到结束符后会结束输入并抛弃结束符，因此这里只用进行一次getline读取来抛弃结束符，而mystr的作用只是存储读入的字符。
C++:cin、cin.getline()、getline()的用法
u010818987: 我用了 cin.ignore(); 先清空之前输入的一个回车（比如你之前有cin >> x）不清空的话 getline(cin, myString); 不会提示你输入
浮点数二进制表示
做而论道_CS: 浮点数什么？浮点数，就是计算机中 “科学记数法”。上过初一的，都知道科学记数法：　N = ± 绝对值 × 10^e。绝对值，当然是正数，由一位整数、多位小数组成。 e 则是以 10 为底的指数。将此法，引入到计算机中，就是 “浮点数” 了。 N 以浮点数存放的格式是：　N = (－1)^S × 2^E × (1.) M。 S，代表了 N 的符号。后面的 E，称为阶码，其值为：指数 e + 127。最后的 (1.) M，就是绝对值，整数部分的 1 被省略了。在这个 M 中，并没有符号位，所以，它只是一个无符号数。因此，就不要扯什么 “原码” 了。把初一学的 “科学记数法” 中的 “绝对值、指数 e”，拿过来换算一下，就是计算机中的 “浮点数” 了。浮点数的运算：　相加减，要先对阶，再用绝对值的补码加减。　相乘除，就是绝对值相乘除、阶码相加减。得出了运算的结果后，还需要整理成规范的形式。其实，计算机中的浮点数运算，是由 “浮点机” 实现的。（什么是定点机、浮点机？　你可别说不知道啊！）诸如：对阶、上下溢、规格化...，都是由硬件自动完成的。这些事，也不需要你来编写程序。硬件的原理，及其设计，就由 “电子信息专业” 去干吧。计算机专业的老师，就不要在这里哗众取宠了。计算机专业的学生，学了这些，也是 P 用都没有的。学上半年，也不过是隔靴搔痒而已。计算机专业，了解一点 “定点数、补码” 就行了。对于那些没上过中学又想冒充高雅的人，学就学吧。当然，即使学明白了，也没有什么用处。
C++:cin、cin.getline()、getline()的用法
Vin0sen: 查了下，C11以前的可以用，新版本编译器不行了
C++:cin、cin.getline()、getline()的用法
A+B+A+B+A+B+A+B+A+B: s是字符串也可以的错的原因是因为cin和getline不能同时用，要用两个getline 因为cin之后getline读的是换行

最新文章

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。