ES6正则的扩展实例详解


Posted in Javascript onApril 25, 2017

本文实例讲述了ES6正则的扩展。分享给大家供大家参考,具体如下:

1. RegExp构造函数

ES5中,RegExp构造函数的参数:

参数是字符串,这时第二个参数表示正则表达式的修饰符(flag)

参数是一个正则表示式,这时会返回一个原有正则表达式的拷贝。但是,ES5不允许此时使用第二个参数,添加修饰符,否则会报错。

ES6改变了这种行为。如果RegExp构造函数第一个参数是一个正则对象,那么可以使用第二个参数指定修饰符。而且,返回的正则表达式会忽略原有的正则表达式的修饰符,只使用新指定的修饰符。

2. 字符串的正则表达式

字符串对象共有4个方法,可以使用正则表达式:match()、replace()、search()和split()。

ES6将这4个方法,在语言内部全部调用RegExp的实例方法,从而做到所有与正则相关的方法,全都定义在RegExp对象上。

String.prototype.match 调用 RegExp.prototype[Symbol.match]
String.prototype.replace 调用 RegExp.prototype[Symbol.replace]
String.prototype.search 调用 RegExp.prototype[Symbol.search]
String.prototype.split 调用 RegExp.prototype[Symbol.split]

3. u修饰符

ES6对正则表达式添加了u修饰符,含义为“Unicode模式”,用来正确处理大于\uFFFF的Unicode字符。

也就是说,会正确处理四个字节的UTF-16编码。对于码点大于0xFFFF的Unicode字符,点字符不能识别,必须加上u修饰符。

ES6新增了使用大括号表示Unicode字符,这种表示法在正则表达式中必须加上u修饰符,才能识别。

/\u{61}/.test('a') // false
/\u{61}/u.test('a') // true
/\u{20BB7}/u.test('?') // true

①.点字符

点(.)字符在正则表达式中,含义是除了换行符以外的任意单个字符。对于码点大于0xFFFF的Unicode字符,点字符不能识别,必须加上u修饰符。

var s = '';
/^.$/.test(s) // false
/^.$/u.test(s) // true

上面代码表示,如果不添加u修饰符,正则表达式就会认为字符串为两个字符,从而匹配失败。

②. 量词

使用u修饰符后,所有量词都会正确识别码点大于0xFFFF的Unicode字符。

/a{2}/.test('aa') // true
/a{2}/u.test('aa') // true
/ {2}/.test(' ') // false
/ {2}/u.test(' ') // true

另外,只有在使用u修饰符的情况下,Unicode表达式当中的大括号才会被正确解读,否则会被解读为量词。

/^\u{3}$/.test('uuu') // true

上面代码中,由于正则表达式没有u修饰符,所以大括号被解读为量词。加上u修饰符,就会被解读为Unicode表达式。

③. 预定义模式

u修饰符也影响到预定义模式,能否正确识别码点大于0xFFFF的Unicode字符。

\S是预定义模式,匹配所有不是空格的字符。只有加了u修饰符,它才能正确匹配码点大于0xFFFF的Unicode字符。

利用这一点,可以写出一个正确返回字符串长度的函数。

function codePointLength(text) {
 var result = text.match(/[\s\S]/gu);
 return result ? result.length : 0;
}
var s = '??';
s.length // 4
codePointLength(s) // 2

④. i修饰符

有些Unicode字符的编码不同,但是字型很相近,比如,\u004B与\u212A都是大写的K。

/[a-z]/i.test('\u212A') // false
/[a-z]/iu.test('\u212A') // true

上面代码中,不加u修饰符,就无法识别非规范的K字符。

4. y修饰符

除了u修饰符,ES6还为正则表达式添加了y修饰符,叫做“粘连”(sticky)修饰符。

y修饰符的作用与g修饰符类似,也是全局匹配,后一次匹配都从上一次匹配成功的下一个位置开始。

不同之处在于,g修饰符只要剩余位置中存在匹配就可,而y修饰符确保匹配必须从剩余的第一个位置开始,这也就是“粘连”的涵义。

var s = 'aaa_aa_a';
var r1 = /a+/g;
var r2 = /a+/y;
r1.exec(s) // ["aaa"]
r2.exec(s) // ["aaa"]
r1.exec(s) // ["aa"]
r2.exec(s) // null

上面代码有两个正则表达式,一个使用g修饰符,另一个使用y修饰符。这两个正则表达式各执行了两次,第一次执行的时候,两者行为相同,剩余字符串都是_aa_a。由于g修饰没有位置要求,所以第二次执行会返回结果,而y修饰符要求匹配必须从头部开始,所以返回null。

如果改一下正则表达式,保证每次都能头部匹配,y修饰符就会返回结果了。

var s = 'aaa_aa_a';
var r = /a+_/y;
r.exec(s) // ["aaa_"]
r.exec(s) // ["aa_"]

上面代码每次匹配,都是从剩余字符串的头部开始。

使用lastIndex属性,可以更好地说明y修饰符。

const REGEX = /a/g;
// 指定从2号位置(y)开始匹配
REGEX.lastIndex = 2;
// 匹配成功
const match = REGEX.exec('xaya');
// 在3号位置匹配成功
match.index // 3
// 下一次匹配从4号位开始
REGEX.lastIndex // 4
// 4号位开始匹配失败
REGEX.exec('xaxa') // null

上面代码中,lastIndex属性指定每次搜索的开始位置,g修饰符从这个位置开始向后搜索,直到发现匹配为止。

const REGEX = /a/y;
// 指定从2号位置开始匹配
REGEX.lastIndex = 2;
// 不是粘连,匹配失败
REGEX.exec('xaya') // null
// 指定从3号位置开始匹配
REGEX.lastIndex = 3;
// 3号位置是粘连,匹配成功
const match = REGEX.exec('xaxa');
match.index // 3
REGEX.lastIndex // 4

y修饰符同样遵守lastIndex属性,但是要求必须在lastIndex指定的位置发现匹配。

进一步说,y修饰符号隐含了头部匹配的标志^。

/b/y.exec('aba')
// null

单单一个y修饰符对match方法,只能返回第一个匹配,必须与g修饰符联用,才能返回所有匹配。

5. sticky属性

表示是否设置了y修饰符

var r = /hello\d/y;
r.sticky // true

6. flags属性

ES6为正则表达式新增了flags属性,会返回正则表达式的修饰符。(和前面是一个逆向的过程)

7. RegExp.escape()

字符串必须转义,才能作为正则模式。已经有提议将这个需求标准化,作为RegExp对象的静态方法RegExp.escape()

function escapeRegExp(str) {
 return str.replace(/[\-\[\]\/\{\}\(\)\*\+\?\.\\\^\$\|]/g, '\\$&');
}
let str = '/path/to/resource.html?search=query';
escapeRegExp(str)
// "\/path\/to\/resource\.html\?search=query"
Javascript 相关文章推荐
javascript结合ajax读取txt文件内容
Dec 05 Javascript
javascript获取当前鼠标坐标的方法
Jan 10 Javascript
基于Bootstrap实现图片轮播效果
May 22 Javascript
纯JS实现可拖拽表单的简单实例
Sep 02 Javascript
微信小程序实现带刻度尺滑块功能
Mar 29 Javascript
vue.js动态数据绑定学习笔记
May 19 Javascript
浅谈箭头函数写法在ReactJs中的使用
Aug 22 Javascript
10个最优秀的Node.js MVC框架
Aug 24 Javascript
echarts学习笔记之图表自适应问题详解
Nov 22 Javascript
JavaScript new对象的四个过程实例浅析
Jul 31 Javascript
详解ES6 扩展运算符的使用与注意事项
Nov 12 Javascript
JavaScript实现切换多张图片
Jan 27 Javascript
Javascript中八种遍历方法的执行速度深度对比
Apr 25 #Javascript
详谈js使用in和hasOwnProperty获取对象属性的区别
Apr 25 #Javascript
3分钟掌握常用的JS操作JSON方法总结
Apr 25 #Javascript
vue.js父组件使用外部对象的方法示例
Apr 25 #Javascript
ES6学习笔记之正则表达式和字符串正则方法分析
Apr 25 #Javascript
Javascript中类式继承和原型式继承的实现方法和区别之处
Apr 25 #Javascript
整理一些最近经常遇到的前端面试题
Apr 25 #Javascript
You might like
[原创]php常用字符串输出方法分析(echo,print,printf及sprintf)
2016/07/09 PHP
jQuery 使用手册(六)
2009/09/23 Javascript
setTimeout()与setInterval()方法区别介绍
2013/12/24 Javascript
jQuery中find()方法用法实例
2015/01/07 Javascript
详解JavaScript中双等号引起的隐性类型转换
2016/05/30 Javascript
jQuery插件扩展extend的简单实现原理
2016/06/24 Javascript
深入理解Vuex 模块化(module)
2017/09/26 Javascript
JavaScript实现精美个性导航栏筋斗云效果
2017/10/29 Javascript
原生JS实现的雪花飘落动画效果
2018/05/03 Javascript
webgl实现物体描边效果的方法介绍
2019/11/27 Javascript
[01:34]DAC2018主赛事第四日五佳镜头 Gh巨牙海民助Miracle-死里逃生
2018/04/07 DOTA
python中查找excel某一列的重复数据 剔除之后打印
2013/02/10 Python
linux系统使用python监测网络接口获取网络的输入输出
2014/01/15 Python
python用来获得图片exif信息的库实例分析
2015/03/16 Python
python中defaultdict的用法详解
2017/06/07 Python
Python通过属性手段实现只允许调用一次的示例讲解
2018/04/21 Python
Python基于Floyd算法求解最短路径距离问题实例详解
2018/05/16 Python
Python开发虚拟环境使用virtualenvwrapper的搭建步骤教程图解
2018/09/19 Python
详解Numpy中的广播原则/机制
2018/09/20 Python
Python实现个人微信号自动监控告警的示例
2019/07/03 Python
python设置环境变量的作用和实例
2019/07/09 Python
Pycharm新建模板默认添加个人信息的实例
2019/07/15 Python
基于python实现把图片转换成素描
2019/11/13 Python
python爬取王者荣耀全皮肤的简单实现代码
2020/01/31 Python
从多个tfrecord文件中无限读取文件的例子
2020/02/17 Python
python encrypt 实现AES加密的实例详解
2020/02/20 Python
tensorflow使用L2 regularization正则化修正overfitting过拟合方式
2020/05/22 Python
印度购物网站:TATA CLiQ
2017/11/23 全球购物
Paul’s Boutique官网:英国时尚手袋品牌
2018/03/31 全球购物
岗位职责定义及内容
2013/11/08 职场文书
设计总监岗位职责
2013/12/07 职场文书
幼儿园教师奖惩制度
2014/02/01 职场文书
国窖1573广告词
2014/03/21 职场文书
Golang中异常处理机制详解
2021/06/08 Golang
SpringBoot整合Minio文件存储
2022/04/03 Java/Android
docker compose 部署 golang 的 Athens 私有代理问题
2022/04/28 Servers