oracle正則函式，regexp_substr，按分隔符單行轉多行

阿新 • • 發佈：2019-02-15

/*
ORACLE中的支援正則表示式的函式主要有下面四個：
1，REGEXP_LIKE ：與LIKE的功能相似
2，REGEXP_INSTR ：與INSTR的功能相似
3，REGEXP_SUBSTR ：與SUBSTR的功能相似
4，REGEXP_REPLACE ：與REPLACE的功能相似
它們在用法上與Oracle SQL 函式LIKE、INSTR、SUBSTR 和REPLACE 用法相同，
但是它們使用POSIX 正則表示式代替了老的百分號（%）和萬用字元（_）字元。
POSIX 正則表示式由標準的元字元（metacharacters）所構成：
'^' 匹配輸入字串的開始位置，在方括號表示式中使用，此時它表示不接受該字元集合。
'$' 匹配輸入字串的結尾位置。如果設定了 RegExp 物件的 Multiline 屬性，則 $ 也匹
配 ' ' 或 ' '。
'.' 匹配除換行符之外的任何單字元。
'?' 匹配前面的子表示式零次或一次。
'+' 匹配前面的子表示式一次或多次。
'*' 匹配前面的子表示式零次或多次。
'|' 指明兩項之間的一個選擇。例子'^([a-z]+|[0-9]+)$'表示所有小寫字母或數字組合成的
字串。
'( )' 標記一個子表示式的開始和結束位置。
'[]' 標記一箇中括號表示式。
'{m,n}' 一個精確地出現次數範圍，m=<出現次數<=n，'{m}'表示出現m次，'{m,}'表示至少
出現m次。
um 匹配 num，其中 num 是一個正整數。對所獲取的匹配的引用。
字元簇： 
[[:alpha:]] 任何字母。
[[:digit:]] 任何數字。
[[:alnum:]] 任何字母和數字。
[[:space:]] 任何白字元。
[[:upper:]] 任何大寫字母。
[[:lower:]] 任何小寫字母。
[[:punct:]] 任何標點符號。
[[:xdigit:]] 任何16進位制的數字，相當於[0-9a-fA-F]。
各種操作符的運算優先順序
\轉義符
(), (?:), (?=), [] 圓括號和方括號
*, +, ?, {n}, {n,}, {n,m} 限定符
^, $, anymetacharacter 位置和順序
| 
*/

--建立表
create table fzq
(
  id varchar(4),
  value varchar(10)
);
--資料插入
insert into fzq values
('1','1234560');
insert into fzq values
('2','1234560');
insert into fzq values
('3','1b3b560');
insert into fzq values
('4','abc');
insert into fzq values
('5','abcde');
insert into fzq values
('6','ADREasx');
insert into fzq values
('7','123  45');
insert into fzq values
('8','adc  de');
insert into fzq values
('9','adc,.de');
insert into fzq values
('10','1B');
insert into fzq values
('10','abcbvbnb');
insert into fzq values
('11','11114560');
insert into fzq values
('11','11124560');
--regexp_like
--查詢value中以1開頭60結束的記錄並且長度是7位
select * from fzq where value like '1____60';
select * from fzq where regexp_like(value,'1....60');
--查詢value中以1開頭60結束的記錄並且長度是7位並且全部是數字的記錄。
--使用like就不是很好實現了。
select * from fzq where regexp_like(value,'1[0-9]{4}60');
-- 也可以這樣實現，使用字符集。
select * from fzq where regexp_like(value,'1[[:digit:]]{4}60');
-- 查詢value中不是純數字的記錄
select * from fzq where not regexp_like(value,'^[[:digit:]]+$');
-- 查詢value中不包含任何數字的記錄。
select * from fzq where regexp_like(value,'^[^[:digit:]]+$');
--查詢以12或者1b開頭的記錄.不區分大小寫。
select * from fzq where regexp_like(value,'^1[2b]','i');
--查詢以12或者1b開頭的記錄.區分大小寫。
select * from fzq where regexp_like(value,'^1[2B]');
-- 查詢資料中包含空白的記錄。
select * from fzq where regexp_like(value,'[[:space:]]');
--查詢所有包含小寫字母或者數字的記錄。
select * from fzq where regexp_like(value,'^([a-z]+|[0-9]+)$');
--查詢任何包含標點符號的記錄。
select * from fzq where regexp_like(value,'[[:punct:]]');
/*
理解它的語法就可以了。其它的函式用法類似。

  1*  select regexp_substr('1234-23-45','[[:alnum:]]+') from dual
SQL> /

REGE
----

1234
  1*  select regexp_substr('1234abc-23-45','[[:alnum:]]+') from dual
SQL> /

REGEXP_
-------
1234abc

  1*  select regexp_substr('1234abc-23-45','[[:alnum:]]+') from dual
SQL> /

REGEXP_
-------
1234abc

select REGEXP_SUBSTR('123-456-7890', '-[^-]+-' )
"REGEXP_SUBSTR"
from DUAL;
REGEX
-----
-456-

Oracle中如何使用REGEXP_SUBSTR函式
REGEXP_SUBSTR函式格式如下：

function REGEXP_SUBSTR(String, pattern, position, occurrence, modifier)
__srcstr ：需要進行正則處理的字串
__pattern ：進行匹配的正則表示式
__position ：起始位置，從第幾個字元開始正則表示式匹配（預設為1）
__occurrence ：標識第幾個匹配組，預設為1
__modifier ：模式（'i'不區分大小寫進行檢索；'c'區分大小寫進行檢索。預設為'c'。）

實際應用如下：在oracle中，使用一條語句實現將'34,56,-23'拆分成'34'，'56'，'-23'的集合。

    --1、查詢使用正則分割後的第一個值，也就是34  
    SELECT REGEXP_SUBSTR('34,56,-23','[^,]+',1,1,'i') AS STR FROM DUAL;  
    --結果是：34   
    --2、查詢使用正則分割後的最後一個值，也就是-23  
    SELECT REGEXP_SUBSTR('34,56,-23','[^,]+',1,3,'i') AS STR FROM DUAL;  
    --結果是：-23  
    --3、獲取一個多個數值的列，從而能夠讓結果以多行的形式展示出來  
    SELECT LEVEL FROM DUAL CONNECT BY LEVEL <=7;  
    --結果是：  
    --1  
    --2  
    --3  
    --4  
    --5  
    --6  
    --7  
    --4、將上面REGEXP_SUBSTR的occurrence關聯  
    SELECT NVL(REGEXP_SUBSTR('34,56,-23', '[^,]+', 1, LEVEL, 'i'), 'NULLL') AS STR FROM DUAL CONNECT BY LEVEL <= 7;  
    --結果是：  
    --34  
    --56  
    ---23  
    --null  
    --null  
    --mull  
    --null  
    --5、優化上面的SQL語句，讓生成的行的數量符合實際情況  
    SELECT REGEXP_SUBSTR('34,56,-23', '[^,]+', 1, LEVEL, 'i') AS STR FROM DUAL CONNECT BY LEVEL <= LENGTH('34,56,-23') - LENGTH(REGEXP_REPLACE('34,56,-23', ',', '')) + 1;  
    --結果是：  
    --34  
    --56  
    ---23

一欄位含有逗號分隔的串，如何把這條記錄按分隔符分成多條記錄

select T_PERSON_ID,
       T_PERSON_NAME,
       regexp_substr(T_TYPE_ID, '[^,]+', 1, level) T_TYPE_ID
  from t_info
connect by level <= regexp_count(T_TYPE_ID, ',') + 1
       and T_PERSON_ID = prior T_PERSON_ID
       and prior dbms_random.value is not null;

oracle簡單按分隔符單行轉多行sql

今天看到篇部落格， http://www.cnblogs.com/hankuikui/p/3523013.html ，說的是按分隔符把一列轉成多行，原文給出的方法是：

with tmp_t as
 (select '1001' as userId, '10,12,15' as workgroups
    from dual
  union
  select '1002' as userId, '2,4,5' as workgroups from dual)
select userid,
       substr(tempgroups,
   instr(tempgroups, ',', 1, lv) + 1,
   instr(tempgroups, ',', 1, lv + 1) -
   (instr(tempgroups, ',', 1, lv) + 1))
  from (select userid,
    ',' || workgroups || ',' AS tempgroups,
    length(workgroups || ',') -
    nvl(length(replace(workgroups, ',')) ， 0) AS groupcount
          FROM tmp_t) a,
       (select LEVEL lv from dual CONNECT BY LEVEL <= 5) b
 where b.lv <= a.groupcount
 order by userid, lv

結果為：

使用了CONNECT BY 構造1-5的lv值和instr擷取，詳細分析見原文。

個人看到connect by level <=5總想這替換掉5，只要得到表中最大的,個數就可以了，如下：

with tmp_t as
 (select '1001' as userid, '10,12,15' as workgroups
    from dual
  union
  select '1002' as userid, '2,4,5' as workgroups from dual)
select userid,
  substr(tempgroups,
    instr(tempgroups, ',', 1, lv) + 1,
    instr(tempgroups, ',', 1, lv + 1) -
    (instr(tempgroups, ',', 1, lv) + 1))
  from (select userid,
     ',' || workgroups || ',' as tempgroups,
     length(workgroups || ',') -
     nvl(length(replace(workgroups, ',')) ， 0) as groupcount
     from tmp_t) a,
  (select level lv
     from dual
   connect by level <= (select max(length(workgroups) -
               length(replace(workgroups, ',', ''))) + 1
           from tmp_t)) b
 where b.lv <= a.groupcount
 order by userid, lv

上面的寫法簡單易懂，恰巧昨天看到篇文章，裡面有更好的寫法，原文連結： http://www.dewen.org/q/16184/%E4%BB%A5%E5%A4%8D%E6%9D%82%E6%95%B0%E6%8D%AE%E5%AD%97%E6%AE%B5%E5%88%86%E7%BB%84%E6%9F%A5%E8%AF%A2

更好的寫法如下：

with tmp_t as
 (select '1001' as userid, '10,12,15' as workgroups
    from dual
  union
  select '1002' as userid, '2,4,5' as workgroups from dual)
select userid,
  --regexp_substr(str,reg,起始位置 第幾次)
  regexp_substr(workgroups, '[^,]+', 1, level) clr
  from tmp_t
connect by level <= regexp_count(workgroups, ',') + 1
  --regexp_count(workgroups, ',') 統計字串中,的數量
  --用法參考http://docs.oracle.com/cd/B28359_01/server.111/b28286/functions135.htm#SQLRF51665
  and userid = prior userid
  and prior dbms_random.value is not null

相當簡潔，很不錯的寫法，結果和上面的一樣。

全文完。

oracle正則函式，regexp_substr，按分隔符單行轉多行

oracle正則函式，regexp_substr，按分隔符單行轉多行

ORACLE單行轉多行、ORACLE遞迴查詢

Oracle正則表示式函式：regexp_like、regexp_substr、regexp_instr、regexp_replace

oracle 字符串正則表達式拆分，排序，合並

正則表達式大全，隨用隨查

js中用戶名的正則（字符，數字，下劃線，減號）

訓練過程--正則化(regularization)技巧(包括L2正則化、dropout，資料增廣，早停)

用正則表示式表示IP，埠和子網掩碼

Java 正則校驗金額，只能是正整數或2位小數以內

JavaScript(E5,6) 正則學習總結學習，可看可不看！

Oracle正則表示式REGEXP_SUBSTR用法

正則表示式之grep，egrep

正則表示式聯練習，電子郵箱

python3 正則匹配 re.split，re.finditer，re.findall 方法

js正則驗證手機號，email，郵編

正則表示式匹配中文，英文字母和數字及_長度詳解

Oracle 查詢不區分大小寫（正則函式）

正則表示式貪婪模式，單詞邊界，多行模式，子表示式（java版）

asp中用正則表示式過濾字元，避免注入攻擊

常用正則匹配（手機，郵箱...）

oracle正則函式，regexp_substr，按分隔符單行轉多行

相關推薦