python-18:正则表达式(二)

    1. 正则表达式模式python

            模式            描述正则表达式

            ^                   匹配字符串的开头spa

            $                   匹配字符串的末尾。字符串

            .                   匹配任意字符,除了换行符,当re.DOTALL标记被指定时,则能够匹配包括换行符的任意字符it

            [...]            用来表示一组字符,单独列出:[amk] 匹配 'a','m'或'k'im

            [^...]            不在[]中的字符:[^abc] 匹配除了a,b,c以外的字符。注释

            re*            匹配0个或多个的表达式。字符

            re+            匹配1个或多个的表达式。数字

            re?            匹配0个或1个由前面的正则表达式定义的片断,非贪婪方式ab

            re{ n}

            re{ n,}           精确匹配n个前面表达式。

            re{ n, m}   匹配 n 到 m 次由前面的正则表达式定义的片断,贪婪方式

            a| b           匹配a或b

            (re)           G匹配括号内的表达式,也表示一个组

            (?imx)           正则表达式包含三种可选标志:i, m, 或 x 。只影响括号中的区域。

            (?-imx)           正则表达式关闭 i, m, 或 x 可选标志。只影响括号中的区域。

            (?: re)           相似 (...), 可是不表示一个组

            (?imx: re)   在括号中使用i, m, 或 x 可选标志

            (?-imx: re)   在括号中不使用i, m, 或 x 可选标志

            (?#...)           注释.

            (?= re)           前向确定界定符。若是所含正则表达式,以 ... 表示,在当前位置成功匹配时成功,不然失败。但一旦所含表达式已经尝试,匹配引擎根本没有提升;模式的剩余部分还要尝试界定符的右边。

            (?! re)           前向否认界定符。与确定界定符相反;当所含表达式不能在字符串当前位置匹配时成功

            (?> re)           匹配的独立模式,省去回溯。

            \w           匹配字母数字

            \W           匹配非字母数字

            \s                   匹配任意空白字符,等价于 [\t\n\r\f].

            \S                   匹配任意非空字符

            \d                   匹配任意数字,等价于 [0-9].

            \D           匹配任意非数字

            \A           匹配字符串开始

            \Z                   匹配字符串结束,若是是存在换行,只匹配到换行前的结束字符串。c

            \z                   匹配字符串结束

            \G           匹配最后匹配完成的位置。

            \b                   匹配一个单词边界,也就是指单词和空格间的位置。例如, 'er\b' 能够匹配"never" 中的 'er',但不能匹配 "verb" 中的 'er'。

            \B                   匹配非单词边界。'er\B' 能匹配 "verb" 中的 'er',但不能匹配 "never" 中的 'er'。

            \n, \t, 等.   匹配一个换行符。匹配一个制表符。等

            \1...\9           匹配第n个分组的子表达式。

            \10           匹配第n个分组的子表达式,若是它经匹配。不然指的是八进制字符码的表达式。

            

    2. 贪婪模式和非贪婪模式

        1. 贪婪模式:老是尝试匹配尽量多的字符,python默认的匹配模式

        2. 老是尝试匹配尽量少的字符

        3. 在"*","?","+","{m,n}"后面加上?,使贪婪变成非贪婪

相关文章
相关标签/搜索