이게 정규식이구
([^>]+?[<])\/?(?:br|p)
<ar> here is text which is not want <a> This is what I want! <br>
웹에서 텍스트 스크렙 하는거라서 > 이랑 <br 혹은 p 사이에서 긁는걸 만들어야는데
잘돌아가는데 디버거에서 돌려보면 저 간단한것도 800 스텝이 넘고
웹하나 하는데 몇십만번 돌아가서 시간이 너무 걸리는데
이게 앞부분 틀린거 <ar> 이랑 <a> 사이에 틀린거 잡아내는데 너무 많이 잡아먹더라고요
어떻게 고치는 법 없나여ㅠ?
>가 아닌것이 1개이상 오되 최소매칭을 하고 <가 온뒤 /이 오거나 없어도 무방 그뒤 br이나 p 둘중 하나가 오는 페턴이네
일단 정규식 컴파일을 한뒤 적용하면 성능 향상이 있다
걍 <br 이나 <p 로 split 시켜서 작게 만든뒤 매칭시켜봐
아 ㅋㅋㅋㅋㅋ 졸감사 ㅋㅋㅋㅋㅋ