Python的正則表示式（re包）

阿新 • • 發佈：2020-10-16

1.正則表示式的模式

1）單個字元:

.          任意的一個字元

a|b        字元a或字元b

[afg]      a或者f或者g的一個字元        

[0-4]      0-4範圍內的一個字元

[a-f]      a-f範圍內的一個字元

[^m]       不是m的一個字元

\s         一個空格

\S         一個非空格

\d         [0-9]

\D         [^0-9]

\w         [0-9a-zA-Z]

\W         [^0-9a-zA-Z]

2）重複

緊跟在單個字元之後，表示多個這樣類似的字元


*         重複 >=0 次

+         重複 >=1 次

?         重複 0或者1 次

{m}       重複m次。比如說 a{4}相當於aaaa，再比如說[1-3]{2}相當於[1-3][1-3]

{m, n}    重複m到n次。比如說a{2, 5}表示a重複2到5次。小於m次的重複，或者大於n次的重複都不符合條件。

正則表達          相符的字串舉例

[0-9]{3,5}       9678

a?b              b

a+b              aaaaab

3) 位置

^         字串的起始位置

$         字串的結尾位置

正則表達          相符的字串舉例        不相符字串

^ab.*c$          abeec               cabeec (如果用re.search(), 將無法找到。)

4）返回控制

我們有可能對搜尋的結果進行進一步精簡資訊。比如下面一個正則表示式：

output_(\d{4})

該正則表示式用括號()包圍了一個小的正則表示式，\d{4}。這個小的正則表示式被用於從結果中篩選想要的資訊（在這裡是四位數字）。這樣被括號圈起來的正則表示式的一部分，稱為群(group)。

我們可以m.group(number)的方法來查詢群。group(0)是整個正則表達的搜尋結果，group(1)是第一個群，以此類推。

import re
m = re.search("output_(\d{4})", "output_1986.txt")
print(m.group(1))

2.正則表示式的函式

1)re.match函式

re.match 嘗試從字串的起始位置匹配一個模式，如果不是起始位置匹配成功的話，match()就返回none。

語法：

re.match(pattern, string, flags=0)

程式碼示例：

line = "Cats are smarter than dogs"
matchObj = re.match(r'(.*) are (.*?) .*', line)
print( matchObj.group())
print( matchObj.group(1))
print( matchObj.group(1,2))

Cats are smarter than dogs
Cats
('Cats', 'smarter')

2)re.search函式

re.search 掃描整個字串並返回第一個成功的匹配。匹配成功re.search方法返回一個匹配的物件，否則返回None。

語法：

re.search(pattern, string, flags=0)

程式碼示例：

line = "Cats are smarter than dogs"
matchObj = re.search(r'(.*) are (.*?) .*', line)
print( matchObj.group())
print( matchObj.group(1))
print( matchObj.group(1,2))

Cats are smarter than dogs
Cats
('Cats', 'smarter')

re.match與re.search的區別:
re.match只匹配字串的開始，如果字串開始不符合正則表示式，則匹配失敗，函式返回None；而re.search匹配整個字串，直到找到一個匹配,如果完全匹配不上，則返回None。

3)re.sub()函式

用於替換字串中的匹配項。

語法：

re.sub(pattern, repl, string, count=0, flags=0)

其中
count : 模式匹配後替換的最大次數，預設 0 表示替換所有的匹配。
程式碼示例：

import re
phone = "2004-959-559 # 這是一個國外電話號碼"
# 刪除字串中的 Python註釋
num = re.sub(r'#.*$', "", phone)
print("電話號碼是: ", num) # 電話號碼是:  2004-959-559
 
# 刪除非數字(-)的字串
num2 = re.sub(r'\D', "", phone,2) # \D表示非數字,替換兩次
num = re.sub(r'\D', "", phone) # \D表示非數字，全部替換
print("電話號碼是 : ", num2) # 電話號碼是 :  2004959559 # 這是一個國外電話號碼
print("電話號碼是 : ", num) # 電話號碼是 :  2004959559

4)re.findall()函式

根據正則表示式搜尋字串，將所有符合的子字串放在一給表(list)中返回。
語法：

re.findall(pattern, string, flags=0)

程式碼示例：

line = "Cats are smarter than dogs"
matchObj = re.findall(r'(.*) are (.*?) .*', line)
matchObj

[('Cats', 'smarter')]

參考連結：https://www.cnblogs.com/vamei/archive/2012/08/31/2661870.html

Python的正則表示式（re包）

1.正則表示式的模式 1）單個字元: .任意的一個字元 a|b字元a或字元b [afg]a或者f或者g的一個字元

python正則表示式（re使用）

python正則表示式（re模組）　　跟之前在js中所見到的正則表示式是類似的一：re的常用操作符：

fei 正則表示式_Python中的正則表示式（re模組）！非常重要！

技術標籤：fei 正則表示式一、簡介正則表示式本身是一種小型的、高度專業化的程式語言，而在python中，通過內嵌整合re模組，程式媛們可以直接呼叫來實現正則匹配。正則表示式模式被編譯成一系列的位元組碼，然

Python基礎最難知識點：正則表示式（使用步驟）

前言本文的文字及圖片來源於網路,僅供學習、交流使用,不具有任何商業用途,版權歸原作者所有,如有問題請及時聯絡我們以作處理。

正則匹配問號_學Python一定要過的神奇坎---正則表示式（超詳細）

技術標籤：正則匹配問號用正則表示式查詢電話號碼(d在正則中表示0-9中任一數字)

55分鐘學會正則表示式（來自Github）

推薦幾個正則表示式編輯器 Debuggex ：https://www.debuggex.com/ PyRegex：http://www.pyregex.com/

前端常用的正則表示式（程式碼例項）

　　匹配正整數 || null 　　function checkNumber(theObj) { 　　var reg=/^[1-9]\\d*$|null/; 　　if (reg.test(theObj)) {

常用正則表示式（快速使用）

常用的正則表示式正則表示式說明 ^[0-9]*$ 數字 ^\\d{n}$ n位的數字 ^\\d{n,}$ 至少n位的數字

python中的正則表示式（三）

1.randint（20,30）在20到30中生成隨機數，其中包含20,30 2. dtint = randint(1000000000,1200000000) #生成時間戳在1000000000,1200000000中間隨機生成一串數字dtstr = ctime(dtint)#將時間戳轉化為特定時間格式