1. 程式人生 > >MySQL中REGEXP正則表示式使用大全

MySQL中REGEXP正則表示式使用大全

以前我要查詢資料都是使用like後來發現mysql中也有正則表示式了並且感覺效能要好於like,下面我來給大家分享一下mysql REGEXP正則表示式使用詳解,希望此方法對大家有幫助。

MySQL採用Henry Spencer的正則表示式實施,其目標是符合POSIX 1003.2。請參見附錄C:感謝。MySQL採用了擴充套件的版本,以支援在SQL語句中與REGEXP操作符一起使用的模式匹配操作。請參見3.3.4.7節,“模式匹配”。

在本附錄中,歸納了在MySQL中可用於REGEXP操作的特殊字元和結構,並給出了一些示例。本附錄未包含可在Henry Spencer的regex(7)手冊頁面中發現的所有細節。該手冊頁面包含在MySQL原始碼分發版中,位於regex目錄下的regex.7檔案中。

正則表示式描述了一組字串。最簡單的正則表示式是不含任何特殊字元的正則表示式。例如,正則表示式hello匹配hello。

非平凡的正則表示式採用了特殊的特定結構,從而使得它們能夠與1個以上的字串匹配。例如,正則表示式hello|word匹配字串hello或字串word。

作為一個更為複雜的示例,正則表示式B[an]*s匹配下述字串中的任何一個:Bananas,Baaaaas,Bs,以及以B開始、以s結束、並在其中包含任意數目a或n字元的任何其他字串。

以下是可用於隨REGEXP操作符的表的模式。

應用示例,查詢使用者表中Email格式錯誤的使用者記錄:

SELECT * 
FROM users
WHERE email NOT REGEXP '^[A-Z0-9._%-]
[email protected]
[A-Z0-9.-]+.[A-Z]{2,4}$'

MySQL資料庫中正則表示式的語法,主要包括各種符號的含義。

(^)字元

匹配字串的開始位置,如“^a”表示以字母a開頭的字串。

mysql> select 'xxxyyy' regexp '^xx';

+-----------------------+
| 'xxxyyy' regexp '^xx' |
+-----------------------+
|           1 |
+-----------------------+
1 row in set (0.00 sec)

查詢xxxyyy字串中是否以xx開頭,結果值為1,表示值為true,滿足條件。

($)字元

匹配字串的結束位置,如“X^”表示以字母X結尾的字串。

(.)字元

這個字元就是英文下的點,它匹配任何一個字元,包括回車、換行等。

(*)字元

星號匹配0個或多個字元,在它之前必須有內容。如:

mysql> select 'xxxyyy' regexp 'x*';

這個SQL語句,正則匹配為true。

(+)字元

加號匹配1個或多個字元,在它之前也必須有內容。加號跟星號的用法類似,只是星號允許出現0次,加號則必須至少出現一次。

(?)字元

問號匹配0次或1次。

例項:

現在根據上面的表,可以裝置各種不同型別的SQL查詢以滿足要求。在這裡列出一些理解。考慮我們有一個表為person_tbl和有一個欄位名為名稱:

查詢找到所有的名字以'st'開頭

mysql> SELECT name FROM person_tbl WHERE name REGEXP '^st';

查詢找到所有的名字以'ok'結尾

mysql> SELECT name FROM person_tbl WHERE name REGEXP 'ok$';

查詢找到所有的名字包函'mar'的字串

mysql> SELECT name FROM person_tbl WHERE name REGEXP 'mar';

查詢找到所有名稱以母音開始和'ok'結束 的

mysql> SELECT name FROM person_tbl WHERE name REGEXP '^[aeiou]|ok$';

一個正則表示式中的可以使用以下保留字 

^

所匹配的字串以後面的字串開頭

mysql> select "fonfo" REGEXP "^fo$"; -> 0(表示不匹配) 
mysql> select "fofo" REGEXP "^fo"; -> 1(表示匹配)

$

所匹配的字串以前面的字串結尾

mysql> select "fono" REGEXP "^fono$"; -> 1(表示匹配) 
mysql> select "fono" REGEXP "^fo$"; -> 0(表示不匹配) 
. 

匹配任何字元(包括新行)

mysql> select "fofo" REGEXP "^f.*"; -> 1(表示匹配) 
mysql> select "fonfo" REGEXP "^f.*"; -> 1(表示匹配) 

a*

匹配任意多個a(包括空串)

mysql> select "Ban" REGEXP "^Ba*n"; -> 1(表示匹配) 
mysql> select "Baaan" REGEXP "^Ba*n"; -> 1(表示匹配) 
mysql> select "Bn" REGEXP "^Ba*n"; -> 1(表示匹配)

a+

匹配任意多個a(不包括空串)

mysql> select "Ban" REGEXP "^Ba+n"; -> 1(表示匹配) 
mysql> select "Bn" REGEXP "^Ba+n"; -> 0(表示不匹配) 

a?

匹配一個或零個a

mysql> select "Bn" REGEXP "^Ba?n"; -> 1(表示匹配) 
mysql> select "Ban" REGEXP "^Ba?n"; -> 1(表示匹配) 
mysql> select "Baan" REGEXP "^Ba?n"; -> 0(表示不匹配)

de|abc

匹配de或abc

mysql> select "pi" REGEXP "pi|apa"; -> 1(表示匹配) 
mysql> select "axe" REGEXP "pi|apa"; -> 0(表示不匹配) 
mysql> select "apa" REGEXP "pi|apa"; -> 1(表示匹配) 
mysql> select "apa" REGEXP "^(pi|apa)$"; -> 1(表示匹配) 
mysql> select "pi" REGEXP "^(pi|apa)$"; -> 1(表示匹配) 
mysql> select "pix" REGEXP "^(pi|apa)$"; -> 0(表示不匹配)

(abc)*

匹配任意多個abc(包括空串)

mysql> select "pi" REGEXP "^(pi)*$"; -> 1(表示匹配) 
mysql> select "pip" REGEXP "^(pi)*$"; -> 0(表示不匹配) 
mysql> select "pipi" REGEXP "^(pi)*$"; -> 1(表示匹配) 

{1} 
{2,3}

這是一個更全面的方法,它可以實現前面好幾種保留字的功能

a*

可以寫成a{0,}

a+

可以寫成a{1,}

a?

可以寫成a{0,1}

   在{}內只有一個整型引數i,表示字元只能出現i次;在{}內有一個整型引數i,後面跟一個“,”,表示字元可以出現i次或i次以上;在{}內只有一個整型引數i,後面跟一個“,”,再跟一個整型引數j,表示字元只能出現i次以上,j次以下(包括i次和j次)。其中的整型引數必須大於等於0,小於等於 RE_DUP_MAX(預設是255)。 如果有兩個引數,第二個必須大於等於第一個

[a-dX]

匹配“a”、“b”、“c”、“d”或“X”

[^a-dX]

匹配除“a”、“b”、“c”、“d”、“X”以外的任何字元。

“[”、“]”必須成對使用

mysql> select "aXbc" REGEXP "[a-dXYZ]"; -> 1(表示匹配) 
mysql> select "aXbc" REGEXP "^[a-dXYZ]$"; -> 0(表示不匹配) 
mysql> select "aXbc" REGEXP "^[a-dXYZ]+$"; -> 1(表示匹配) 
mysql> select "aXbc" REGEXP "^[^a-dXYZ]+$"; -> 0(表示不匹配) 
mysql> select "gheis" REGEXP "^[^a-dXYZ]+$"; -> 1(表示匹配) 
mysql> select "gheisa" REGEXP "^[^a-dXYZ]+$"; -> 0(表示不匹配)