스캔한 PDF와 사진에서 글자를 읽어내는 OCR을 추가했습니다
Nova PDF Converter에 OCR(이미지에서 텍스트 추출) 을 추가했습니다. 스캔한 PDF나 서류를 찍은 사진에서, 선택하고 검색할 수 있는 텍스트를 꺼낼 수 있습니다.

할 수 있는 것
- 스캔 PDF와 이미지 모두 지원: PDF는 페이지를 이미지로 다시 그린 뒤 인식합니다. PNG나 JPEG 사진을 그대로 넣어도 됩니다
- 11개 언어: 일본어·영어·중국어(간체/번체)·한국어·스페인어·프랑스어·독일어·포르투갈어·이탈리아어·러시아어
- 결과를 바로 복사·저장: 읽어낸 텍스트를 원클릭으로 복사하거나 텍스트 파일로 내려받을 수 있습니다
- 여러 페이지 PDF: 앞에서부터 50페이지까지 한 번에 처리하며, 진행 상황을 페이지 단위로 표시합니다
기존의 '텍스트 추출'은 PDF 안에 들어 있는 텍스트 레이어를 꺼내는 도구입니다. 스캔한 PDF는 사실상 이미지라서 그 도구로는 아무것도 나오지 않습니다. 그럴 때는 OCR로 안내하도록 해 두었습니다.
사용 방법
- OCR 도구를 엽니다
- PDF나 이미지를 끌어다 놓습니다
- 인식할 언어를 고르고 '문자 읽기'를 누릅니다
- 결과를 복사하거나 텍스트 파일로 저장합니다
가입도 설치도 필요 없습니다. 처음 한 번만 인식 데이터를 내려받고, 이후에는 캐시됩니다.
데이터 처리에 대해
인식은 모두 브라우저 안에서 실행됩니다. PDF도 이미지도, 읽어낸 텍스트도 서버로 전송되지 않습니다. 속도는 기기 성능에 따라 달라지지만, 대신 파일이 밖으로 나가지 않습니다.
모든 기능을 무료로 사용할 수 있습니다.
이럴 때 유용합니다
- 스캔본만 있는 종이 서류에서 필요한 부분만 텍스트로 인용하고 싶을 때
- 찍어 둔 자료나 화이트보드 내용을 검색 가능한 텍스트로 남기고 싶을 때
- 이미지로만 보관된 오래된 자료를 다시 검색할 수 있게 만들고 싶을 때
Novare Orbis에서는 브라우저에서 완결되는 무료 도구를 그 밖에도 공개하고 있습니다. 도구 목록은 여기.