javascript 正则表达式分组、断言详解

提示：阅读本文需要有一定的正则表达式基础。

正则表达式中的断言，作为高级应用出现，倒不是因为它有多难，而是概念比较抽象，不容易理解而已，今天就让小菜通俗的讲解一下。

如果不用断言，以往用过的那些表达式，仅仅能获取到有规律的字符串，而不能获取无规律的字符串。

举个例子，比如html源码中有xxx标签，用以前的知识，我们只能确定源码中的和是固定不变的。因此，如果想获取页面标题(xxx)，充其量只能写一个类似于这样的表达式：.*，而这样写匹配出来的是完整的xxx标签，并不是单纯的页面标题xxx。

想解决以上问题，就要用到断言知识。

在讲断言之前，读者应该先了解分组，这有助于理解断言。

分组在正则中用()表示，根据小菜理解，分组的作用有两个：

效果。

先来看第一个作用，对于IP地址的匹配，简单的可以写为如下形式：

\d{1,3}.\d{1,3}

但仔细观察，我们可以发现一定的规律，可以把.\d{1,3}看成一个整体，也就是把他们看成一组，再把这个组重复3次即可。表达式如下：

\d{1,3}(.\d{1,3}){3}

这样一看，就比较简洁了。

再来看第二个作用，就拿匹配xxx标签来说，简单的正则可以这样写：

可以看出，上边表达式中有两个title，完全一样，其实可以通过分组简写。表达式如下：

<(title)>.*

这个例子实际上就是反向引用的实际应用。对于分组而言，整个表达式永远算作第0组，在本例中，第0组是<(title)>.*，然后从左到右，依次为分组编号，因此，(title)是第1组。

用\1这种语法，可以引用某组的文本内容，\1当然就是引用第1组的文本内容了，这样一来，就可以简化正则表达式，只写一次title，把它放在组里，然后在后边引用即可。

以此为启发，我们可不可以简化刚刚的IP地址正则表达式呢？原来的表达式为\d{1,3}){3}，里边的\d{1,3}重复了两次，如果利用后向引用简化，表达式如下：

(\d{1,3})(.\1){3}

简单的解释下，把\d{1,3}放在一组里，表示为(\d{1,3})，它是第1组，(.\1)是第2组，在第2组里通过\1语法，后向引用了第1组的文本内容。

经过实际测试，会发现这样写是错误的，为什么呢？

小菜一直在强调，

后向引用，引用的仅仅是文本内容，而不是正则表达式！

也就是说，组中的内容一旦匹配成功，后向引用，

引用的就是匹配成功后的内容，引用的是结果，而不是表达式。

因此，(\d{1,3})(.\1){3}这个表达式实际上匹配的是四个数都相同的IP地址，比如：123.123.123.123。

至此，读者已经掌握了传说中的后向引用，就这么简单。

接下来说说什么是断言。

所谓断言，就是指明某个字符串前边或者后边，将会出现满足某种规律的字符串。

就拿文章开篇的例子来说，我们想要的是xxx，它没有规律，但是它前边肯定会有，后边肯定会有，这就足够了。

想指定xxx前肯定会出现，就用正后发断言，表达式：(?<=<title>).*</p> <p> 向指定xxx后边肯定会出现，就用正先行断言，表达式：.*(?=)

两个加在一起，就是(?<=).*(?=)

这样就能匹配到xxx。

相信读者看到这，已经蒙了，不用急，待小菜慢慢讲来。

其实掌握了规律，就很简单了，无论是先行还是后发，都是相对于xxx而言的，也就是相对于目标字符串而言。

假如目标字符串后边有条件，可以理解为目标字符串在前，就用先行断言，放在目标字符串之后。

假如目标字符串前边有条件，可以理解为目标字符串在后，就用后发断言，放在目标字符串之前。

假如指定满足某个条件，就是正。

假如指定不满足某个条件，就是负。

断言只是条件，帮你找到真正需要的字符串，本身并不会匹配！

(?=X )

零宽度正先行断言。仅当子表达式 X 在此位置的右侧匹配时才继续匹配。例如，/w+(?=/d) 与后跟数字的单词匹配，而不与该数字匹配。此构造不会回溯。

(?!X)

零宽度负先行断言。仅当子表达式 X 不在此位置的右侧匹配时才继续匹配。例如，例如，/w+(?!/d) 与后不跟数字的单词匹配，而不与该数字匹配。

(?<=X)

零宽度正后发断言。仅当子表达式 X 在此位置的左侧匹配时才继续匹配。例如，(?<=19)99 与跟在 19 后面的 99 的实例匹配。此构造不会回溯。

(? 零宽度负后发断言。仅当子表达式 X 不在此位置的左侧匹配时才继续匹配。例如，(?

从断言的表达形式可以看出，它用的就是分组符号，只不过开头都加了一个问号，这个问号就是在说这是一个非捕获组，这个组没有编号，不能用来后向引用，只能当做断言。

教程到此结束，希望大家阅读愉快！

原文链接：https://www.f2er.com/js/39835.html

javascript js 断言断言断言正则表达式正则表达式分组、断言详解

上一篇：JS利用cookies设置每隔24小时弹出框下一篇：ES6新特性一： let和const命令详解

猜你在找的JavaScript相关文章

Javascript中的事件冒泡与捕获

事件冒泡和事件捕获起因：今天在封装一个bind函数的时候，发现el.addEventListener函数支...

作者：前端之家时间：2021-02-22

搞懂js中小数运算精度问题原因及解决办法

js小数运算会出现精度问题 js number类型 JS 数字类型只有number类型，number类型相当于其...

作者：前端之家时间：2021-02-22

搞懂：前端跨域问题JS解决跨域问题VUE代理解决跨域问题原理

什么是跨域跨域：广义的跨域包含一下内容： 1.资源跳转（链接跳转，重定向跳转，表单提...

作者：前端之家时间：2021-02-22

前端对base64编码的理解，原生js实现字符base64编码

@ "TOC" 常见对base64的认知(不完全正确) 首先对base64常见的认知，也是...

作者：前端之家时间：2021-02-22

搞懂：MVVM模型以及VUE中的数据绑定数据劫持发布订阅模式

搞懂：MVVM模式和Vue中的MVVM模式 MVVM MVVM ：的缩写，说都能直接说出来：模型，：视图...

作者：前端之家时间：2021-02-22

js判断浏览器是否支持webGL

起因是我之前开发的网页，用到了three.js制作了一个3d的旋转球体效果。在各种浏览器上运行...

作者：前端之家时间：2021-02-14

js判断undefined和null

js判断undefined js判断null js判断null和undefined

作者：前端之家时间：2021-02-14

将文字自动转为banner打印形式的工具

http://patorjk.com/software/taag/

作者：前端之家时间：2021-02-14

聊一聊 bootstrap 的轮播图插件

今天做工作的时候，轻车熟路的做完，又用到了bootstrap的轮播图，觉得有必要安利一下这个插...

作者：前端之家时间：2021-02-14

js实现图片无缝循环跑马灯

html 代码 css js代码 function mylsRunHorseLight() { if (mylsTimer != null) { clearIn...

作者：前端之家时间：2021-02-14