이미지와 스캔된 PDF에서 텍스트 추출 — 무료, 비공개, 브라우저 기반 OCR
- 이미지 또는 스캔된 PDF를 업로드합니다
- OCR 언어와 선택적 전처리를 선택합니다
- 추출된 텍스트를 검토, 편집 및 내보냅니다
Proof: 클라이언트 측 처리로 14개 언어를 지원합니다. 파일은 브라우저를 벗어나지 않습니다.
사진, 스크린샷, 스캔 문서 및 PDF에서 텍스트를 추출합니다 — 서버 업로드 없이 전적으로 브라우저에서 처리됩니다.
- 14개 언어를 지원합니다: English, Spanish, French, German, Italian, Portuguese 및 그 외 8개 언어.
- 페이지별 텍스트 추출과 페이지 구분자를 포함해 여러 페이지의 스캔된 PDF를 처리합니다.
- 내장 전처리: 품질이 낮은 스캔의 정확도를 높이기 위한 그레이스케일 및 고대비 모드.
대부분의 무료 OCR 도구는 파일을 알 수 없는 서버에 업로드하거나, 한 페이지로 제한하거나, 광고와 가입 장벽 뒤에 결과를 숨깁니다. 이 도구는 WebAssembly를 사용해 전적으로 브라우저에서 실행되므로 파일이 기기를 벗어나지 않습니다.
Google와 LibreOffice에서 사용하는 것과 같은 오픈 소스 OCR 엔진인 Tesseract.js로 구동됩니다.
OCR 추출기
아래에 이미지 또는 PDF를 업로드하세요. 처리는 브라우저에서 로컬로 실행됩니다.
이미지와 스캔된 PDF에서 텍스트를 추출하는 방법
1. 파일을 업로드합니다
최대 20 MB의 JPEG, PNG, TIFF, WebP, BMP 또는 스캔된 PDF를 드롭하거나 선택합니다. 최대 20페이지의 여러 페이지 PDF는 페이지별로 처리되며 출력에는 명확한 구분자가 포함됩니다.
2. 언어와 설정을 선택합니다
14개 언어 중에서 선택합니다. 품질이 낮은 스캔의 정확도를 높이려면 그레이스케일 또는 고대비 전처리를 활성화합니다.
3. 텍스트가 로컬에서 추출됩니다
Tesseract OCR 엔진은 WebAssembly를 통해 브라우저에서 실행됩니다. 파일은 어디에도 전송되지 않습니다.
4. 편집하고 내보냅니다
추출된 텍스트를 검토하고 OCR 오류를 바로 수정한 다음, 클립보드에 복사하거나 .txt 파일로 다운로드합니다.
OCR 모범 사례
고해상도 스캔을 사용합니다
OCR 정확도는 해상도에 따라 크게 향상됩니다. 300 DPI 이상을 권장합니다. 스캔하는 경우 가능한 가장 높은 품질 설정을 사용하세요.
희미한 텍스트에는 전처리를 시도합니다
영수증, 오래된 문서 또는 색이 바랜 출력물에는 고대비 모드를 활성화하세요. 그레이스케일은 OCR을 혼동시키는 컬러 배경에 도움이 됩니다.
신뢰도 점수를 확인합니다
신뢰도 점수가 60% 미만이면 보통 스캔 품질이 너무 낮다는 뜻입니다. 더 높은 해상도로 다시 스캔하거나 전처리 설정을 조정해 보세요.
공유 전에 결과를 정리합니다
OCR은 절대 100% 정확하지 않습니다. 특히 숫자, 고유명사, 특수문자는 OCR이 자주 잘못 인식하므로 항상 결과를 검토하세요.
내용을 기준으로 문서를 정리하세요
문서에서 텍스트를 추출한 후에는 renamed.to가 내용에 따라 파일을 자동으로 정리하고 이름을 변경하도록 할 수 있습니다.
시작 시 50회 무료 이름 변경이 제공됩니다. 신용카드는 필요하지 않습니다.
자주 묻는 질문
이 OCR 도구의 정확도는 어느 정도인가요?
정확도는 이미지 품질에 따라 달라집니다. 선명한 고해상도 인쇄 텍스트 스캔은 일반적으로 90-98% 정확도를 달성합니다. 손글씨, 저해상도 이미지, 특이한 글꼴은 더 낮은 정확도를 보입니다. 어려운 스캔에서는 결과를 개선하기 위해 전처리 옵션을 사용하세요.
파일이 서버에 업로드되나요?
아니요. 모든 OCR 처리는 WebAssembly(Tesseract.js)를 사용해 브라우저에서 로컬로 실행됩니다. 파일은 기기를 벗어나지 않습니다. 유일한 네트워크 요청은 처음 사용할 때 공개 CDN에서 OCR 엔진과 언어 데이터를 불러오는 것입니다.
어떤 이미지 형식을 지원하나요?
JPEG, PNG, TIFF, WebP, BMP 이미지를 지원하며, 최대 20페이지의 스캔된 PDF 문서도 지원합니다. 최대 파일 크기는 20 MB입니다.
다른 언어의 텍스트도 OCR할 수 있나요?
예. 이 도구는 14개 언어를 지원합니다: English, Spanish, French, German, Italian, Portuguese, Dutch, Polish, Russian, Chinese (Simplified), Japanese, Korean, Arabic, Turkish. 최상의 결과를 위해 OCR 실행 전에 언어를 선택하세요.
OCR 정확도를 어떻게 높일 수 있나요?
가장 도움이 되는 것은 세 가지입니다: (1) 고해상도 스캔(300+ DPI) 사용, (2) 그레이스케일 및 고대비 같은 전처리 옵션 활성화, (3) 문서가 충분히 밝고 기울어지지 않았는지 확인. 여러 페이지 PDF의 경우 각 페이지는 독립적으로 처리됩니다.