웹서핑하다가 좋은 기사 있으면 스크롤 캡처했음..

이 그림 파일에서 원래의 문장을 추출하려고 했음..

몇몇 무료 OCR 프로그램은 오동작.... ㅠ ㅠ

구글 드라이브에서 OCR 해주는 경우에는 색깔별로 이상하게 출력됨... ㅠ ㅠ 

그래서 좋은 프로그램을 새로 만들까 하고 궁리해 봤음... 


1. 먼저 폰트와 폰트 사이즈를 확인하는 코드를 만들었음.. chatGPT-4o가 만들어 줌. 나는 프로그래머가 아님... 

2. 폰트와 폰트 사이즈가 다른 문장들이 혼합되어 있기 마련임.. 그래서 이를 분류하여 그룹으로 만드는 코드를 추가함... 


이 2가지를 적당히 활용하면, 화면을 캡처한 그림에서 OCR하는 것은 가능할 듯해...