고급 OCR

전체 페이지 OCR · Searchable PDF · 다중 출력 · 배치 처리. 브라우저에서 바로. 100% 무료, 개인정보 보호.

OCR은 스캔된 페이지와 사진 속 텍스트를 읽어 실제 선택 가능한 텍스트로 변환합니다. 스캔된 계약서나 촬영된 페이지에 적용하면 시각적으로 동일하지만 아래에 텍스트 레이어가 있어 Ctrl+F가 작동하고 텍스트를 복사하거나 다른 도구로 추출할 수 있는 검색 가능한 PDF를 얻을 수 있습니다. 출력은 일반 텍스트 또는 구조화된 문서 형식일 수도 있습니다. 인식은 WebAssembly로 컴파일된 Tesseract를 사용하여 전적으로 브라우저에서 실행됩니다. 이는 대부분의 서비스가 문서를 업로드해야 하는 OCR에서는 드문 방식이며, 비라틴어 스크립트를 포함한 다양한 언어를 지원합니다.

  1. 파일 업로드 — 파일을 업로드 영역으로 드래그 앤 드롭하거나, 클릭하여 기기에서 파일을 선택하세요.
  2. 옵션 설정 — 전체 페이지 OCR · Searchable PDF · 다중 출력 · 배치 처리
  3. 다운로드 — 다운로드 버튼을 클릭하여 처리된 파일을 저장하세요. 즉시 완료됩니다!

자주 묻는 질문

어떤 언어를 지원하나요?

영어, 한국어, 일본어, 중국어 및 주요 유럽 언어를 포함한 다양한 언어와 비라틴어 스크립트를 지원합니다. 실행 전에 올바른 언어를 선택하는 것이 정확도에 큰 영향을 미칩니다.

얼마나 정확한가요?

인쇄된 텍스트의 깨끗한 300 DPI 스캔본에서는 정확도가 높습니다. 해상도가 낮거나, 기울어지거나, 그림자가 지거나, 대비가 좋지 않거나, 손글씨일 경우 정확도가 떨어집니다 — 특히 손글씨는 안정적으로 인식되지 않습니다.

문서가 OCR 서버로 업로드되나요?

아니요. 인식은 WebAssembly를 통해 브라우저에서 실행됩니다. 파일은 귀하의 장치를 벗어나지 않으므로, 중요한 문서의 경우 클라우드 OCR 서비스 대신 이 기능을 사용하는 주된 이유입니다.

최상의 결과를 얻으려면 어떻게 해야 하나요?

300 DPI로 스캔하고, 페이지를 똑바로 유지하고, 그림자를 피하고, 올바른 언어를 선택하세요. 인식 전에 기울기 보정 및 대비 조정을 하는 것도 눈에 띄게 도움이 됩니다.

최적화

  • PDF 압축 — PDF 파일 크기를 줄입니다
  • 이미지 추출 — PDF에서 임베디드 이미지를 추출합니다
  • PDF 분석 — PDF 문서 정보를 상세히 분석합니다