前言前端
正则表达式在几乎全部语言中均可以使用,不管是前端的JavaScript、仍是后端的Java、c#。他们都提供相应的接口/函数支持正则表达式。正则表达式
但很神奇的是:不管你大学选择哪一门计算机语言,都没有关于正则表达式的课程给你修,在你学会正则以前,你只能看着那些正则大师们,写了一串外星文似的字符串,替代了你用一大篇幅的if else代码来作一些数据校验。c#
既然喜欢,那就动手学呗,可当你百度出一一堆相关资料时,你发现无一不例外的枯燥至极,难以学习。后端
本文旨在用最通俗的语言讲述最枯燥的基本知识!函数
万物皆有缘,正则也是如此,元字符是构造正则表达式的一种基本元素。
咱们先来记几个经常使用的元字符:学习
元字符spa |
说明code |
.blog |
匹配除换行符之外的任意字符教程 |
\w |
匹配字母或数字或下划线或汉字 |
\s |
匹配任意的空白符 |
\d |
匹配数字 |
\b |
匹配单词的开始或结束 |
^ |
匹配字符串的开始 |
$ |
匹配字符串的结束 |
有了元字符以后,咱们就能够利用这些元字符来写一些简单的正则表达式了,
好比
1. 匹配有abc开头的字符串:
1\babc或者^abc
2. 匹配8位数字的QQ号码:
1^\d\d\d\d\d\d\d\d$
3. 匹配1开头11位数字的手机号码:
1^1\d\d\d\d\d\d\d\d\d\d$
有了元字符就能够写很多的正则表达式了,但细心的大家可能会发现:别人写的正则简洁明了,而不理君写的正则一堆乱七八糟并且重复的元字符组成的。正则没提供办法处理这些重复的元字符吗?
答案是有的!
为了处理这些重复问题,正则表达式中一些重复限定符,把重复部分用合适的限定符替代,下面咱们来看一些限定符:
语法 |
说明 |
* |
重复零次或更屡次 |
+ |
重复一次或更屡次 |
? |
重复零次或一次 |
{n} |
重复n次 |
{n,} |
重复n次或更屡次 |
{n,m} |
重复n到m次 |
有了这些限定符以后,咱们就能够对以前的正则表达式进行改造了,好比:
1. 匹配8位数字的QQ号码:
1^\d{8}$
2. 匹配1开头11位数字的手机号码:
1^1\d{10}$
3. 匹配银行卡号是14~18位的数字:
1^\d{14,18}$
4. 匹配以a开头的,0个或多个b结尾的字符串
1^ab*$
从上面的例子(4)中看到,*限定符是做用在与他左边最近的一个字符,那么问题来了,若是我想要ab同时被*限定那怎么办呢?
正则表达式中用小括号()来作分组,也就是括号中的内容做为一个总体。
所以当咱们要匹配多个ab时,咱们能够这样
如:匹配字符串中包含0到多个ab开头:
1^(ab)*
咱们看到正则表达式用小括号来作分组,那么问题来了:
若是要匹配的字符串中自己就包含小括号,那是否是冲突?应该怎么办?
针对这种状况,正则提供了转义的方式,也就是要把这些元字符、限定符或者关键字转义成普通的字符,作法很简答,就是在要转义的字符前面加个斜杠,也就是\便可。
如:要匹配以(ab)开头:
1^(\(ab\))*
回到咱们刚才的手机号匹配,咱们都知道:国内号码都来自三大网,它们都有属于本身的号段,好比联通有130/131/132/155/156/185/186/145/176等号段,假如让咱们匹配一个联通的号码,那按照咱们目前所学到的正则,应该无从下手的,由于这里包含了一些并列的条件,也就是“或”,那么在正则中是如何表示“或”的呢?
正则用符号 | 来表示或,也叫作分支条件,当知足正则里的分支条件的任何一种条件时,都会当成是匹配成功。
那么咱们就能够用或条件来处理这个问题
1^(130|131|132|155|156|185|186|145|176)\d{8}$
看到上面的例子,是否是看到有什么规律?是否是还有一种想要简化的冲动?
实际是有的
正则提供一个元字符中括号 [] 来表示区间条件。
1. 限定0到9 能够写成[0-9]
2. 限定A-Z 写成[A-Z]
3. 限定某些数字 [165]
那上面的正则咱们还改为这样:
1^((13[0-2])|(15[56])|(18[5-6])|145|176)\d{8}$
好了,正则表达式的基本用法就讲到这里了,其实它还有很是多的知识点以及元字符,咱们在此只列举了部分元字符和语法来说,旨在给那些不懂正则或者想学正则但有看不下去文档的人作一个快速入门级的教程,看完本教程,即便你不能写出高大上的正则,至少也能写一些简单的正则或者看得懂别人写的正则了。