Python正規表示式基礎

pythontab發表於2013-06-19

原文網址 : https://www.pythontab.com/html/2013/pythonjichu_0619/452.html

Python

正規表示式是搜尋、替換和解析複雜字串的一種強大而標準的方法，Python中的正則相關的東西全在re模組下。

1 常用的匹配

^匹配字串的開始

$匹配字串的結尾

\b匹配一個單詞的邊界

\d匹配任意數字

\D匹配任意非數字字元

x?匹配一個可選的x（匹配1次或0次x字元）

x*匹配0次或多次x

x+匹配1次或多次x

x{n,m}至少n次，至多m次x

(a|b|c)要麼匹配a，要麼匹配b，要麼匹配c

(x)一般情況下表示一個記憶組，你可以利用re.search函式返回物件的groups()函式來獲取它的值

2 一般用途

#-------------------------------------------------------------------------------
# coding:        utf-8
# Purpose:正規表示式
#
# Author:      zdk
#
# Created:     26/02/2013
# Copyright:   (c) zdk 2013
#-------------------------------------------------------------------------------
 
import re
if __name__ == '__main__':
    addr = "100 BROAD ROAD APT.3"
    print(re.sub("ROAD","RD",addr)) # 100 BRD RD APT.3
    print(re.sub(r"\bROAD\b","RD",addr)) # 100 BROAD RD APT.3
    pattern = ".*B.*(ROAD)?"
    print(re.search(pattern,"ROAD")) #None
    print(re.search(pattern,"B")) #<_sre.SRE_Match object at 0x0230F020><span style="background-color:#FAFAFA;font-family:Monaco, 'DejaVu Sans Mono', 'Bitstream Vera Sans Mono', Consolas, 'Courier New', monospace;font-size:1em;line-height:1.5;">&nbsp;</span>

（1）re.sub("ROAD","RD",addr) 利用re.sub函式對字串addr進行搜尋，滿足表示式"ROAD"的用“RD”替換

（2）re.sub(r"\bROAD\b","RD",addr) ，“\b”含義是“單詞的邊界”，在Python中，由於字元“\”在字串中必須轉義，這會變得非常麻煩，所以Python用字首r表示字串中的所有字元都不轉義。

（3）re.search(pattern,"ROAD") re模組有一個search函式，該函式有兩個引數，一個是正規表示式，一個是字串，search函式返回一個擁有多種方法可以描述這個匹配的物件，如果沒有發現匹配，則返回None。

3 鬆散正規表示式

上面均是“緊湊”型別的表示式，它比較難以閱讀，即使現在清楚表示式的含義，也不能保證幾個月後還能記得。所以Python允許使用者利用所謂的鬆散正規表示式來完成內聯文件的需要，和一般的表示式有以下兩個方面的主要區別

忽略空白符。空格符、製表符、回車符不匹配它們自身（如果你想在鬆散正規表示式中匹配一個空格符，你不須在它前面新增一個反斜槓符號對它進行轉義）

忽略註釋。和普通的Python程式碼一樣，註釋開始於#符號，結束於行尾。

#鬆散帶有內聯註釋的正規表示式
    pattern = """
    ^   # begin of string
    M{0,3} # 0 to 3 M
    (CM|CD|D?C{0,3}) #CM or CD or D or D 0 to 3 C
    $   #end of string
    """
    print(re.search(pattern,"MCM",re.VERBOSE)) #<_sre.SRE_Match object at 0x021BAF60>
    print(re.search(pattern,"M99",re.VERBOSE)) #None

（1）當使用鬆散正規表示式時，最重要的一件事就是：必須傳遞一個額外的引數re.VERBOSE，它是re模組的一個常量，標誌著待匹配的正規表示式是一個鬆散正規表示式。pattern的空格和註釋都是被忽略的，但同時具有更好的可讀性。

4 個例研究：解析電話號碼

必須匹配如下電話號碼：

800-555-1212

800 555 1212

800.555.1212

(800)555-1212

1-800-555-1212

800-555-1212-1234

800-555-1212x1234

800-555-1212 ext.1234

work 1-(800) 555,1212 #1234

格式比較多，我們需要知道的是800為區號，幹線號為555，電話號的其他數字為1212，對於有分機號的，我們需要知道分機號為1234

phonePattern = re.compile(r'''
    # don't match beginging of string
(\d{3}) # 3 digits
\D*     #any number of non-digits
(\d{3}) # 3 digits
\D*     #any number of non-digits
(\d{4}) # 4 digits
\D*     #any number of non-digits
(\d*)   #any number of digits
''',re.VERBOSE)
print(phonePattern.search('work 1-(800)555.1212 #1234').groups()) #('800', '555', '1212', '1234')

print(phonePattern.search('work 1-(800)555.1212 #1234').groups()) #('800', '555', '1212', '1234')

（1）一個鬆散正規表示式如上，首先匹配3個數字區號（不一定從第一個字元開始，所以沒有用^），接著後面匹配任意多個非數字的字元，接著匹配3個數字幹線號，接著匹配任意多個非數字的字元，接著匹配4個數字號碼，接著匹配任意多個非數字的字元，接著匹配任意多個數字的分機號，然後用groups函式分組，得到正確的電話號碼。

Python基礎之正規表示式
2024-06-30
Python
python基礎操作——正規表示式
2023-04-10
Python
正規表示式基礎
2019-12-23
Python--之正規表示式一基礎
2018-04-06
Python
JS基礎：正規表示式
2021-09-09
JS
shell基礎 — 基本正規表示式
2018-10-08
前端基礎之正規表示式
2018-07-07
前端
bash基礎特性、正規表示式
2019-07-15
正規表示式基礎知識
2018-04-15
python基礎之正規表示式和re模組
2020-03-12
Python
JavaScript基礎-06-正規表示式
2020-08-12
JavaScript
正規表示式(一) 基礎知識
2018-03-21
Python——正規表示式
2019-08-05
Python
python正規表示式
2024-06-15
Python
Python 正規表示式
2021-09-09
Python
Python：正規表示式
2021-04-22
Python
PHP基礎系列之正規表示式(一)
2019-02-16
PHP
【重溫基礎】9.正規表示式
2019-02-16
正規表示式基礎知識總結
2019-01-03
JavaSE基礎:”頭疼”的正規表示式
2019-01-23
Java
JavaSE基礎:"頭疼"的正規表示式
2018-04-09
Java
python之正規表示式
2018-08-11
Python
python 正規表示式匹配
2024-04-19
Python
Python正規表示式手稿
2020-04-04
Python
Python正規表示式大全
2020-11-26
Python
JS基礎教程——正規表示式示例(推薦)
2022-03-16
JS
Python正規表示式詳解
2023-11-24
Python
Python 正規表示式（RegEx）指南
2023-11-02
Python
詳解 Python 正規表示式
2020-11-20
Python
正規表示式（python3）
2021-03-11
Python
Python基礎學習篇-4-常用的正規表示式處理函式
2019-08-25
Python函式
Python 正規表示式 re 模組
2018-10-12
Python
python re模組正規表示式
2018-09-12
Python
Python-day-15-正規表示式
2018-08-03
Python
Python 之 RE（正規表示式）常用
2020-03-16
Python
python正規表示式(re模組)
2020-08-08
Python
python 關於正規表示式re
2020-04-21
Python
Python正規表示式初識（四）
2021-09-09
Python
python正規表示式（簡明版）
2020-12-19
Python

Python正規表示式基礎

相關文章