码迷,mamicode.com
首页 > 其他好文 > 详细

复习总结正则表达式-下

时间:2017-11-13 13:36:00      阅读:120      评论:0      收藏:0      [点我收藏+]

标签:引用   not   des   nbsp   margin   断言   一个   查找   注释   

9.后向引用(重复搜索前面某个分组匹配的文本)

\1代表分组1匹配的文本

例子:匹配重复的单词 比如:hello hello 、 hi hi

正则表达式:\b(\w+)\b\s+\1\b

解释:也就是单词开始处和结束处之间的多于一个的字母或数字(\b(\w+)\b),这个单词会被捕获到编号为1的分组中,

然后是1个或几个空白符(\s+),最后是分组1中捕获的内容(也就是前面匹配的那个单词)(\1)。

你也可以自己指定子表达式的组名。要指定一个子表达式的组名,请使用这样的语法:(?<Word>\w+)(或者把尖括号换成‘也行:(?‘Word‘\w+)),这样就把\w+的组名指定为Word了。要反向引用这个分组捕获的内容,你可以使用\k<Word>,所以上一个例子也可以写成这样:

\b(?<Word>\w+)\b\s+\k<Word>\b。

使用小括号的时候,还有很多特定用途的语法。下面列出了最常用的一些:

 

分类代码/语法说明

捕获

(exp):匹配exp,并捕获文本到自动命名的组里

(?<name>exp):匹配exp,并捕获文本到名称为name的组里,也可以写成(?‘name‘exp)

(?:exp):匹配exp,不捕获匹配的文本,也不给此分组分配组号

零宽断言

(?=exp):匹配exp前面的位置

(?<=exp):匹配exp后面的位置

(?!exp):匹配后面跟的不是exp的位置

(?<!exp):匹配前面不是exp的位置

注释

(?#comment):这种类型的分组不对正则表达式的处理产生任何影响,用于提供注释让人阅读

 

10.零宽断言

 

接下来的四个用于查找在某些内容(但并不包括这些内容)之前或之后的东西,也就是说它们像\b,^,$那样用于指定一个位置,这个位置应该满足一定的条件(即断言),因此它们也被称为零宽断言。最好还是拿例子来说明吧:

(断言用来声明一个应该为真的事实。正则表达式中只有当断言为真时才会继续进行匹配)

(?=exp)也叫零宽度正预测先行断言,它断言自身出现的位置的后面能匹配表达式exp。

比如\b\w+(?=ing\b),匹配以ing结尾的单词的前面部分(除了ing以外的部分),

如查找I‘m singing while you‘re dancing.时,它会匹配sing和danc。

(?<=exp)也叫零宽度正回顾后发断言,它断言自身出现的位置的前面能匹配表达式exp。

比如(?<=\bre)\w+\b会匹配以re开头的单词的后半部分(除了re以外的部分),

例如在查找reading a book时,它匹配ading。

 

假如你想要给一个很长的数字中每三位间加一个逗号(当然是从右边加起了),你可以这样查找需要在前面和里面添加逗号的部分:

((?<=\d)\d{3})+\b,用它对1234567890进行查找时结果是234567890。

下面这个例子同时使用了这两种断言:(?<=\s)\d+(?=\s)匹配以空白符间隔的数字(再次强调,不包括这些空白符)。

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

复习总结正则表达式-下

标签:引用   not   des   nbsp   margin   断言   一个   查找   注释   

原文地址:http://www.cnblogs.com/mhq-martin/p/7825606.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!