성에 대한 기준이 필요할꺼잖아. ㅇㅇ
무조건 첫글자를 성으로 간주할꺼라면 SUBSTR 사용하면 되지.
,,, 보관자체를 성/이름 나눠서 하던가
SUBSTR로 돌리면 로 / 버트할리 이렇게 나오니깐...
내말이... 누가 저렇게 디비에 쳐넣고 성 이름으로 나누고 싶대...
저 정도는 케이스가 너무 많아서 쿼리만으로는 안된다. ㅇㅇ 특히 외국인의 성과 성이 전혀 없는 것 포함 되고 애매모호한 기준에 걸치는 데이터도 있기 때문에..
case문이나 decode로 처리하는 것도 한계가 있고, 그나마 가능한 모든 성을 별도의 Table에 넣고 substr 한것은 in으로 비교하는 방법도 저것처럼 완전히 성이 앞부분에 나온다는 것을 담보하지 못한다면 의미가 없징. ㅇㅇ
cre_ate table(성 varchar2(10), 이름 varchar2(10), 순서 char(1))
물론.. 기존 데이터 대상으로 수작업을 포함해서 노가다로 하나씩 큰 덩어리를 제거해서 최대한 기존에 혼합되어 있는 데이터를 정리할 수 있는 방법은 있겠지. 샘플링이랑 보편적 형태 유추 같은 것을 통해서.
고마워, 인사팀에서 저런걸 던져주길래 순간 내가 멍청해진줄 알았음.
일종의 자연어 검색 엔진 만든다는 수준에 가까워질듯. ㅋㅋ
성에 대한 기준이 필요할꺼잖아. ㅇㅇ
무조건 첫글자를 성으로 간주할꺼라면 SUBSTR 사용하면 되지.
,,, 보관자체를 성/이름 나눠서 하던가
SUBSTR로 돌리면 로 / 버트할리 이렇게 나오니깐...
내말이... 누가 저렇게 디비에 쳐넣고 성 이름으로 나누고 싶대...
저 정도는 케이스가 너무 많아서 쿼리만으로는 안된다. ㅇㅇ 특히 외국인의 성과 성이 전혀 없는 것 포함 되고 애매모호한 기준에 걸치는 데이터도 있기 때문에..
case문이나 decode로 처리하는 것도 한계가 있고, 그나마 가능한 모든 성을 별도의 Table에 넣고 substr 한것은 in으로 비교하는 방법도 저것처럼 완전히 성이 앞부분에 나온다는 것을 담보하지 못한다면 의미가 없징. ㅇㅇ
cre_ate table(성 varchar2(10), 이름 varchar2(10), 순서 char(1))
물론.. 기존 데이터 대상으로 수작업을 포함해서 노가다로 하나씩 큰 덩어리를 제거해서 최대한 기존에 혼합되어 있는 데이터를 정리할 수 있는 방법은 있겠지. 샘플링이랑 보편적 형태 유추 같은 것을 통해서.
고마워, 인사팀에서 저런걸 던져주길래 순간 내가 멍청해진줄 알았음.
일종의 자연어 검색 엔진 만든다는 수준에 가까워질듯. ㅋㅋ