티스토리 뷰
정규 표현식(Regular expression)은 데이터 중에 원하는 조건과 일치하는 데이터를 찾아내기 위해 사용하는 것입니다.
자사 설루션(solution) 리팩토링 할 때 기존에는 DBMS별 정규식으로 분석하고 DBMS별로 표현식을 관리했었습니다.
신규로 추가해야 하는 DBMS 중 정규식 함수가 없어서 Java 정규식을 사용해 관리를 해야 했었습니다.
문제점으로 DBMS별로 정규식과 패턴에 결괏값이 조금씩 상이했고 패턴들을 관리하기 어려운 점이 있었습니다. 여러 가지로 고려했을 때 공통적인 결괏값, 패턴 관리를 효율적으로 하기 위해 Java 정규식을 사용하는 게 제일 좋다고 생각했습니다. 속도를 비교하기 위해 10만 건 동일한 데이터와 패턴으로 DBMS별로 속도 테스트를 했을 때 자바정규식과 큰 속도 차이는 없었습니다. 그래서 자바 정규식으로 변경했습니다.
아래 코드블록은 자바 정규식 matcher 클래스를 사용한 예제 코드입니다.
Pattern pattern = Pattern.compile("^[0-9]+$");
Matcher m = pattern.matcher("1234");
System.out.println(m.find()); // 결과: true
정규식에서 제일 헷갈렸던 메타 문자는 곱셈기호(*), 덧셈기호(+)입니다.
* : 0번 이상 발생
+ : 1번 이상 발생
아래 예제를 보면 비교 데이터가 "" 빈 문자일 때 곱셈기호(*)는 true이고 덧셈기호 (+)는 false입니다.
Pattern m_pattern = Pattern.compile("^[0-9]*$");
Matcher m1 = m_pattern.matcher("");
Pattern p_pattern = Pattern.compile("^[0-9]+$");
Matcher m2 = p_pattern.matcher("");
System.out.println(m1.find()); // * 기호 결과: true
System.out.println(m2.find()); // + 기호 결과: false
끝.
728x90
'Java' 카테고리의 다른 글
[Java] compareTo() (0) | 2023.09.12 |
---|---|
[Java] Remove HTML tags (0) | 2023.04.13 |
[Java] Call by Value & Reference (0) | 2023.01.15 |
[Java] PMD를 활용한 코드 개선 (0) | 2022.12.27 |
[Java] distinct() (0) | 2022.12.15 |
공지사항
최근에 올라온 글
최근에 달린 댓글
- Total
- Today
- Yesterday
링크
TAG
- If
- Lower
- bool
- Python
- permutations
- counter
- find
- zip
- function
- isalpha
- index
- isdigit
- combinations
- Lambda
- Method
- for
- operators
- Upper
- Built-in Functions
일 | 월 | 화 | 수 | 목 | 금 | 토 |
---|---|---|---|---|---|---|
1 | 2 | 3 | ||||
4 | 5 | 6 | 7 | 8 | 9 | 10 |
11 | 12 | 13 | 14 | 15 | 16 | 17 |
18 | 19 | 20 | 21 | 22 | 23 | 24 |
25 | 26 | 27 | 28 | 29 | 30 | 31 |
글 보관함