웹 서핑하다가 좋은 글 좋은 기사 있으면 스크롤 캡처해 둔다. 

그런데 캡처 내용을 글로 뽑으려고 하면 문제가 생긴다. 

캡처 그림을 보면서 열심히 타이핑하는 건 너무 지겨워서..... 

그래서 생각한 게 OCR 기능을 이용하는 건데, 

유료는 매달 돈을 내야 하니 싫고, 

무료로 가능한 것 중에서 구글 드라이브를 사용한 OCR을 사용해 봤다. 

성능이 어느 정도 만족스럽더라. 

그럼에도 불구하고 더 나은 성능을 바란다.


내게 한 가지 아이디어가 있다 

지금 화면에 표시되는 글자는 맑은고딕 폰트이고, 폰트 사이즈는 10이다. 

한글을 가나다라마바사아자차카타파하 거너더러머버서어저처커터퍼허.... 

이런 식으로 모든 글자를 1세트로 하면 1만2천 자 정도가 된다고 하더라. 

그 중에서 '가'라는 글자만 생각해 보자. 

흰색 배경색에 ㄱ, ㅏ 가 합쳐져서 '가'라는 글자가 되었다. 

'가'라는 글자를 포함하는 사각형 영역을 구하면, 

다른 곳은 다 흰 색이고, ㄱ과 ㅏ 부분만 검은색 또는 회색으로 되어 있을 것이다. 


이 사각형 안의 점들의 RGB 값을 더하면, '가'라는 글자에 대한 고유 RGB 값이 나올 것이다.

그리고 다른 모든 한글 글자도 고유 RGB 값이 나올 것이다. (값이 중복될 수는 있다.)

그러면 다른 모든 한글 글자의 고유 RGB 값 리스트를 만들 수 있을 것이다. 

즉 맑은고딕 폰트이고, 폰트 사이즈가 10일 때의 RGB 값 리스트가 생긴다. 


OCR을 할 때는 글자마다 사각형 영역을 설정하고, RGB값을 더하고, 위에서 만든 리스트와 비교한다... 

그러면 틀릴 가능성이 거의 없는 OCR이 되지 않을까?