oracle正則函式,regexp_substr,按分隔符單行轉多行
阿新 • • 發佈:2019-02-15
/* ORACLE中的支援正則表示式的函式主要有下面四個: 1,REGEXP_LIKE :與LIKE的功能相似 2,REGEXP_INSTR :與INSTR的功能相似 3,REGEXP_SUBSTR :與SUBSTR的功能相似 4,REGEXP_REPLACE :與REPLACE的功能相似 它們在用法上與Oracle SQL 函式LIKE、INSTR、SUBSTR 和REPLACE 用法相同, 但是它們使用POSIX 正則表示式代替了老的百分號(%)和萬用字元(_)字元。 POSIX 正則表示式由標準的元字元(metacharacters)所構成: '^' 匹配輸入字串的開始位置,在方括號表示式中使用,此時它表示不接受該字元集合。 '$' 匹配輸入字串的結尾位置。如果設定了 RegExp 物件的 Multiline 屬性,則 $ 也匹 配 ' ' 或 ' '。 '.' 匹配除換行符之外的任何單字元。 '?' 匹配前面的子表示式零次或一次。 '+' 匹配前面的子表示式一次或多次。 '*' 匹配前面的子表示式零次或多次。 '|' 指明兩項之間的一個選擇。例子'^([a-z]+|[0-9]+)$'表示所有小寫字母或數字組合成的 字串。 '( )' 標記一個子表示式的開始和結束位置。 '[]' 標記一箇中括號表示式。 '{m,n}' 一個精確地出現次數範圍,m=<出現次數<=n,'{m}'表示出現m次,'{m,}'表示至少 出現m次。 um 匹配 num,其中 num 是一個正整數。對所獲取的匹配的引用。 字元簇: [[:alpha:]] 任何字母。 [[:digit:]] 任何數字。 [[:alnum:]] 任何字母和數字。 [[:space:]] 任何白字元。 [[:upper:]] 任何大寫字母。 [[:lower:]] 任何小寫字母。 [[:punct:]] 任何標點符號。 [[:xdigit:]] 任何16進位制的數字,相當於[0-9a-fA-F]。 各種操作符的運算優先順序 \轉義符 (), (?:), (?=), [] 圓括號和方括號 *, +, ?, {n}, {n,}, {n,m} 限定符 ^, $, anymetacharacter 位置和順序 | */
Oracle中如何使用REGEXP_SUBSTR函式--建立表 create table fzq ( id varchar(4), value varchar(10) ); --資料插入 insert into fzq values ('1','1234560'); insert into fzq values ('2','1234560'); insert into fzq values ('3','1b3b560'); insert into fzq values ('4','abc'); insert into fzq values ('5','abcde'); insert into fzq values ('6','ADREasx'); insert into fzq values ('7','123 45'); insert into fzq values ('8','adc de'); insert into fzq values ('9','adc,.de'); insert into fzq values ('10','1B'); insert into fzq values ('10','abcbvbnb'); insert into fzq values ('11','11114560'); insert into fzq values ('11','11124560'); --regexp_like --查詢value中以1開頭60結束的記錄並且長度是7位 select * from fzq where value like '1____60'; select * from fzq where regexp_like(value,'1....60'); --查詢value中以1開頭60結束的記錄並且長度是7位並且全部是數字的記錄。 --使用like就不是很好實現了。 select * from fzq where regexp_like(value,'1[0-9]{4}60'); -- 也可以這樣實現,使用字符集。 select * from fzq where regexp_like(value,'1[[:digit:]]{4}60'); -- 查詢value中不是純數字的記錄 select * from fzq where not regexp_like(value,'^[[:digit:]]+$'); -- 查詢value中不包含任何數字的記錄。 select * from fzq where regexp_like(value,'^[^[:digit:]]+$'); --查詢以12或者1b開頭的記錄.不區分大小寫。 select * from fzq where regexp_like(value,'^1[2b]','i'); --查詢以12或者1b開頭的記錄.區分大小寫。 select * from fzq where regexp_like(value,'^1[2B]'); -- 查詢資料中包含空白的記錄。 select * from fzq where regexp_like(value,'[[:space:]]'); --查詢所有包含小寫字母或者數字的記錄。 select * from fzq where regexp_like(value,'^([a-z]+|[0-9]+)$'); --查詢任何包含標點符號的記錄。 select * from fzq where regexp_like(value,'[[:punct:]]'); /* 理解它的語法就可以了。其它的函式用法類似。 1* select regexp_substr('1234-23-45','[[:alnum:]]+') from dual SQL> / REGE ---- 1234 1* select regexp_substr('1234abc-23-45','[[:alnum:]]+') from dual SQL> / REGEXP_ ------- 1234abc 1* select regexp_substr('1234abc-23-45','[[:alnum:]]+') from dual SQL> / REGEXP_ ------- 1234abc select REGEXP_SUBSTR('123-456-7890', '-[^-]+-' ) "REGEXP_SUBSTR" from DUAL; REGEX ----- -456-
REGEXP_SUBSTR函式格式如下:
function REGEXP_SUBSTR(String, pattern, position, occurrence, modifier)
__srcstr :需要進行正則處理的字串
__pattern :進行匹配的正則表示式
__position :起始位置,從第幾個字元開始正則表示式匹配(預設為1)
__occurrence :標識第幾個匹配組,預設為1
__modifier :模式('i'不區分大小寫進行檢索;'c'區分大小寫進行檢索。預設為'c'。)
實際應用如下:在oracle中,使用一條語句實現將'34,56,-23'拆分成'34','56','-23'的集合。
--1、查詢使用正則分割後的第一個值,也就是34 SELECT REGEXP_SUBSTR('34,56,-23','[^,]+',1,1,'i') AS STR FROM DUAL; --結果是:34 --2、查詢使用正則分割後的最後一個值,也就是-23 SELECT REGEXP_SUBSTR('34,56,-23','[^,]+',1,3,'i') AS STR FROM DUAL; --結果是:-23 --3、獲取一個多個數值的列,從而能夠讓結果以多行的形式展示出來 SELECT LEVEL FROM DUAL CONNECT BY LEVEL <=7; --結果是: --1 --2 --3 --4 --5 --6 --7 --4、將上面REGEXP_SUBSTR的occurrence關聯 SELECT NVL(REGEXP_SUBSTR('34,56,-23', '[^,]+', 1, LEVEL, 'i'), 'NULLL') AS STR FROM DUAL CONNECT BY LEVEL <= 7; --結果是: --34 --56 ---23 --null --null --mull --null --5、優化上面的SQL語句,讓生成的行的數量符合實際情況 SELECT REGEXP_SUBSTR('34,56,-23', '[^,]+', 1, LEVEL, 'i') AS STR FROM DUAL CONNECT BY LEVEL <= LENGTH('34,56,-23') - LENGTH(REGEXP_REPLACE('34,56,-23', ',', '')) + 1; --結果是: --34 --56 ---23
一欄位含有逗號分隔的串,如何把這條記錄按分隔符分成多條記錄
select T_PERSON_ID,
T_PERSON_NAME,
regexp_substr(T_TYPE_ID, '[^,]+', 1, level) T_TYPE_ID
from t_info
connect by level <= regexp_count(T_TYPE_ID, ',') + 1
and T_PERSON_ID = prior T_PERSON_ID
and prior dbms_random.value is not null;
oracle簡單按分隔符單行轉多行sql
今天看到篇部落格, http://www.cnblogs.com/hankuikui/p/3523013.html ,說的是按分隔符把一列轉成多行,原文給出的方法是 :
with tmp_t as
(select '1001' as userId, '10,12,15' as workgroups
from dual
union
select '1002' as userId, '2,4,5' as workgroups from dual)
select userid,
substr(tempgroups,
instr(tempgroups, ',', 1, lv) + 1,
instr(tempgroups, ',', 1, lv + 1) -
(instr(tempgroups, ',', 1, lv) + 1))
from (select userid,
',' || workgroups || ',' AS tempgroups,
length(workgroups || ',') -
nvl(length(replace(workgroups, ',')) , 0) AS groupcount
FROM tmp_t) a,
(select LEVEL lv from dual CONNECT BY LEVEL <= 5) b
where b.lv <= a.groupcount
order by userid, lv
結果為 :使用了CONNECT BY 構造1-5的lv值和instr擷取,詳細分析見原文 。
個人看到connect by level <=5總想這替換掉5,只要得到表中最大的,個數就可以了,如下 :
with tmp_t as
(select '1001' as userid, '10,12,15' as workgroups
from dual
union
select '1002' as userid, '2,4,5' as workgroups from dual)
select userid,
substr(tempgroups,
instr(tempgroups, ',', 1, lv) + 1,
instr(tempgroups, ',', 1, lv + 1) -
(instr(tempgroups, ',', 1, lv) + 1))
from (select userid,
',' || workgroups || ',' as tempgroups,
length(workgroups || ',') -
nvl(length(replace(workgroups, ',')) , 0) as groupcount
from tmp_t) a,
(select level lv
from dual
connect by level <= (select max(length(workgroups) -
length(replace(workgroups, ',', ''))) + 1
from tmp_t)) b
where b.lv <= a.groupcount
order by userid, lv
上面的寫法簡單易懂,恰巧昨天看到篇文章,裡面有更好的寫法,原文連結 :
http://www.dewen.org/q/16184/%E4%BB%A5%E5%A4%8D%E6%9D%82%E6%95%B0%E6%8D%AE%E5%AD%97%E6%AE%B5%E5%88%86%E7%BB%84%E6%9F%A5%E8%AF%A2
更好的寫法如下 :
with tmp_t as
(select '1001' as userid, '10,12,15' as workgroups
from dual
union
select '1002' as userid, '2,4,5' as workgroups from dual)
select userid,
--regexp_substr(str,reg,起始位置 第幾次)
regexp_substr(workgroups, '[^,]+', 1, level) clr
from tmp_t
connect by level <= regexp_count(workgroups, ',') + 1
--regexp_count(workgroups, ',') 統計字串中,的數量
--用法參考http://docs.oracle.com/cd/B28359_01/server.111/b28286/functions135.htm#SQLRF51665
and userid = prior userid
and prior dbms_random.value is not null
相當簡潔,很不錯的寫法,結果和上面的一樣 。
全文完 。