0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0
OCR: 이미지·PDF를 텍스트로
이미지, 스크린샷 또는 PDF에서 텍스트를 추출합니다. PDF의 경우 문서 자체의 텍스트(서명 및 필드 포함)와 이미지의 광학 문자 인식(OCR)을 결합합니다. 모든 과정은 브라우저에서 진행되며 파일이 서버로 업로드되지 않습니다.

이미지나 PDF를 끌어다 놓거나 클릭하여 선택하세요

PDF, PNG, JPEG, WebP, GIF, BMP

이미지에 포함된 언어를 하나 이상 선택하세요

작동 방식

OCR(광학 문자 인식)는 이미지나 PDF(사진, 스크린샷, 스캔한 문서) 안에 있는 텍스트를 복사, 검색, 붙여넣기가 가능한 편집 가능한 텍스트로 변환합니다.

정확도를 높이기 위해 하나 이상의 언어를 선택할 수 있습니다. 올바른 언어를 지정하면 엔진이 악센트, 특수 문자, 단어 전체를 더 잘 해석합니다. 어떤 언어를 처음 사용하면 해당 모델이 다운로드되고 이후를 위해 저장됩니다.

모든 인식은 WebAssembly를 사용해 브라우저에서 이루어지며 파일은 어떤 서버에도 업로드되지 않습니다. 결과에는 신뢰도 추정값이 포함되어 인식이 얼마나 정확했는지 알 수 있습니다.

활용 사례

  • 선택할 수 없는 스크린샷의 텍스트를 복사하기.
  • 스캔한 문서, 청구서 또는 영수증을 편집하기 위해 디지털화하기.
  • 사진에서 코드 조각이나 오류 메시지를 추출하기.
  • 번역하거나 검색하기 위해 이미지에서 텍스트를 복구하기.
  • 디지털이든 스캔본이든 PDF에서 텍스트를 추출해 재사용하기.

자주 묻는 질문

내 이미지가 서버에 업로드되나요?

아니요. 인식은 전적으로 브라우저에서 실행되며 이미지는 절대 기기를 벗어나지 않습니다. 선택한 언어 모델만 한 번 다운로드됩니다.

텍스트 언어를 왜 선택해야 하나요?

언어마다 고유의 학습된 모델이 있습니다. 올바른 언어를 선택하면 특히 악센트나 언어 고유 문자에서 정확도가 크게 향상됩니다. 이미지에 여러 언어가 섞여 있으면 한 번에 여러 개를 선택할 수 있습니다.

더 나은 결과를 얻으려면 어떻게 하나요?

텍스트와 배경의 대비가 좋은 선명하고 밝은 이미지를 사용하세요. 기울어지거나 흐릿하거나 손글씨인 사진보다 수평이고 왜곡이 없는 텍스트가 더 잘 인식됩니다.

어떤 형식을 사용할 수 있나요?

일반적인 형식의 이미지(PNG, JPEG, WebP, GIF, BMP)는 물론 PDF 파일도 사용할 수 있습니다. 문서의 경우 해상도가 좋은 스크린샷이나 스캔본일수록 결과가 좋습니다.

PDF는 어떻게 처리되나요?

페이지별로 처리하며 사용 가능한 모든 텍스트를 결합합니다. PDF 자체의 텍스트(양식 필드와 전자 서명 포함)를 직접 정확하게 추출하고, 이미지 안의 텍스트도 OCR로 인식합니다. "디지털" PDF는 즉시 읽히지만, 스캔본이나 이미지가 많은 PDF는 더 오래 걸릴 수 있습니다.