브라우저에서 바로 처리

PDF OCR

스캔한 PDF를 검색하고 선택할 수 있는 PDF로 바꿉니다. OCR은 브라우저 안에서 로컬로 실행되므로 파일이 기기를 벗어나지 않습니다.

로컬 처리업로드 0건평균 약 1.2초회원가입 불필요

아무것도 업로드하지 않음

PDF OCR 엔진이 WebAssembly로 브라우저 안에서 실행됩니다. 스캔본이 서버로 전송되는 일은 없습니다.

무엇을 읽었는지 확인

인식된 단어가 페이지 위에 표시되므로, 내려받기 전에 결과를 직접 확인할 수 있습니다.

11개 언어 지원

라틴 문자, 키릴 문자, CJK 문자를 모두 지원합니다. 중국어, 일본어, 한국어, 러시아어도 포함됩니다.

무료, 가입 불필요

계정도, 워터마크도, 페이지 제한도 없습니다. 실질적인 한계는 기기의 메모리뿐입니다.

요약: PDF OCR은 스캔된 페이지에서 글자를 읽어내어 보이지 않는 텍스트 레이어로 PDF에 다시 기록합니다. 페이지 모습은 그대로지만, 드디어 검색하고 선택하고 복사할 수 있게 됩니다. 이 작업은 전부 브라우저 안에서 이루어집니다.

스캔한 PDF가 업무를 가로막는 이유

거래처에서 계약서가 돌아왔습니다. 조항 하나를 찾아야 합니다. Ctrl+F를 누르고 단어를 입력하면 PDF는 결과가 없다고 말합니다. 그 단어가 화면에 뻔히 보이는데도 말이죠.

대부분의 사람이 PDF OCR을 찾기 시작하는 순간입니다. 문서가 고장 난 게 아닙니다. 애초에 텍스트가 들어 있지 않았을 뿐입니다.

스캔본은 문서가 아니라 사진입니다

스캐너나 휴대폰 카메라가 종이를 담을 때 기록하는 것은 픽셀입니다. 눈에 보이는 글자는 모양일 뿐 문자가 아닙니다. PDF 뷰어 입장에서 그 페이지는 납작한 이미지 한 장입니다.

문자 인식이 없으면 잃는 것들

검색 불가. 복사·붙여넣기 불가. 인용을 위한 선택 불가. 스크린 리더는 아무것도 읽어 주지 않습니다. 문서관리 시스템은 빈 파일로 색인합니다. 이 모든 기능은 페이지에 진짜 문자가 들어 있어야 작동합니다.

가장 곤란해지는 경우

서명된 계약서, 종이 청구서, 영수증, 진료 기록, 학술 논문, 오래된 문서. 나중에 가장 검색하고 싶어지는 문서이면서, 동시에 가장 자주 스캔본으로 도착하는 문서입니다.

PDF OCR이란?

PDF OCR은 스캔된 페이지 이미지에서 글자를 읽어내어, 실제로 존재하지만 보이지 않는 텍스트 레이어로 PDF에 다시 저장하는 과정입니다. 페이지는 그대로 보이지만, 이제 그 위의 단어를 검색하고 선택하고 복사할 수 있습니다.

OCR은 광학 문자 인식(optical character recognition)의 약자입니다. 엔진은 페이지의 형태를 살펴 특정 언어의 글자꼴과 대조한 뒤, 문자와 각 단어의 정확한 위치를 함께 내놓습니다.

보이지 않는 텍스트 레이어의 원리

인식된 단어는 PDF 텍스트 렌더링 모드 3으로 페이지에 다시 그려집니다. 이 모드는 “이 텍스트를 그리되 표시하지는 말라”는 뜻입니다. 각 단어는 스캔 이미지 속 자기 자리 바로 위에 놓입니다.

그래서 제대로 OCR 처리된 파일은 겉보기에 전혀 달라지지 않으면서도 검색하면 정확히 강조됩니다. 선택되는 것은 이미지가 아니라 보이지 않는 레이어입니다.

검색 가능한 PDF와 순수 텍스트 추출의 차이

검색 가능한 PDF가 필요할 때

원래 모습을 유지해야 하는 경우입니다. 서명, 도장, 레터헤드, 레이아웃. 보기 좋게 남아야 하거나 법적으로 식별되어야 하는 문서는 PDF로 두는 편이 좋습니다.

텍스트만 필요할 때

메일이나 스프레드시트, 메모에 붙여 넣을 것이라면 PDF는 건너뛰고 텍스트 내보내기를 쓰세요. 이 도구는 한 번의 실행으로 둘 다 제공합니다.

OCR로도 해결되지 않는 것

OCR은 거기 있는 것을 읽을 뿐입니다. 스캔 과정에서 뭉개진 글자를 되살리지 못하고, 교정도 해 주지 않습니다. 비뚤어진 저해상도 사진에서는 비뚤어진 저품질 결과가 나옵니다.

3단계로 PDF에 OCR 적용하기

모든 처리는 여러분의 기기에서 이루어집니다. 대기열도, 업로드도, 대기 화면도 없습니다.

  1. 1

    스캔한 PDF 열기

    위 영역에 파일을 끌어다 놓거나 기기에서 선택하세요. 브라우저 탭으로 바로 불러옵니다. 업로드라는 단계 자체가 없습니다.

  2. 2

    문서 언어 선택

    화면 표시 언어가 아니라, 페이지에 실제로 인쇄된 언어를 고르세요. 엔진은 해당 언어 팩을 한 번만 내려받고 이후에는 캐시에서 사용합니다.

  3. 3

    OCR 실행 후 내려받기

    페이지별 진행 상황을 보며 강조된 단어를 확인한 뒤, 검색 가능한 PDF나 순수 텍스트를 받으세요. 둘 다 로컬에서 생성됩니다.

유용한 팁언어 선택은 생각보다 훨씬 큰 영향을 줍니다. 독일어 페이지를 영어로 돌리면 움라우트가 전부 망가집니다. 결과가 알아볼 수 없게 나온다면 대개 언어가 원인입니다.

참고새 언어를 처음 쓸 때는 3MB 미만의 언어 팩을 내려받습니다. 그다음부터는 즉시 시작되고 오프라인에서도 동작합니다.

OCR이 실제로 무엇을 읽었는지 확인하세요

대부분의 PDF OCR 도구는 파일만 건네주고 행운을 빌어 줍니다. 제대로 됐는지는 내려받아 PDF를 열고 직접 검색해 봐야 알 수 있습니다.

이건 손해 보는 거래입니다. 스캔 품질 편차가 매우 크고, PDF OCR은 조용히 실패하기 때문입니다. 정확도 60%를 말없이 돌려주는 도구는 99%짜리와 겉모습이 똑같습니다.

텍스트 레이어를 눈에 보이게

“텍스트 레이어 표시”를 켜면 인식된 단어마다 페이지 위에 상자가 그려집니다. 화면에 보이는 그것이 곧 PDF에 기록된 내용입니다.

내려받기 전에 나쁜 스캔을 알아보는 법

엔진이 확신하지 못한 단어는 빨간색으로 표시됩니다. 상자에 마우스를 올리면 실제로 무엇으로 읽었는지, 확신도가 얼마인지 볼 수 있습니다.

빨간 상자가 드문드문 있는 정도는 괜찮습니다. 페이지 대부분이 빨갛다면 뭔가 잘못된 것입니다. 대개는 언어를 잘못 골랐거나, 더 높은 해상도로 다시 스캔해야 하는 경우입니다.

검색 가능한 PDF로 할 수 있는 일

텍스트 레이어가 생기는 순간, 그 문서는 어디에서 쓰든 비로소 진짜 문서처럼 동작합니다.

문서 안에서 검색

Ctrl+F는 어떤 PDF 뷰어에서도, 어떤 기기에서도 작동합니다. 60쪽짜리 스캔 계약서에서 조항 하나 찾는 일이 더 이상 손으로 넘기는 작업이 아닙니다.

다시 타이핑하지 않고 복사·인용

문단을 선택해 메일이나 보고서에 붙여 넣으세요. 옮겨 적을 필요도, 그 과정에서 오타가 끼어들 일도 없습니다.

스캔본을 접근성 있게

스크린 리더가 읽을 수 있는 것은 텍스트 레이어뿐입니다. 스캔 자료가 쌓인 보관함이라면 OCR 한 번이 접근성을 가장 크게 개선하는 조치인 경우가 많습니다.

다른 도구에 깔끔한 텍스트 전달

검색 색인, 메모 앱, 번역 도구, 스프레드시트 모두 픽셀이 아니라 문자가 필요합니다. 텍스트 내보내기는 그대로 넣으면 됩니다.

스캔본은 이 탭을 벗어나지 않습니다

스캔 문서는 대개 사람이 가진 가장 민감한 파일입니다. 서명한 계약서, 여권, 세무 서류, 진단서. 검색이 되게 하려고 그런 파일을 낯선 서버에 올린다는 건 이상한 거래입니다.

이 도구는 PDF OCR 엔진을 WebAssembly로 브라우저에 불러와 그 안에서 실행합니다. 언어 팩은 저희 서버에서 오지만, 여러분의 문서는 어디로도 가지 않습니다. 페이지가 로드된 뒤 네트워크를 끊어도 작업은 끝까지 완료됩니다.

브라우저 PDF OCR과 업로드 방식 OCR 도구 비교

개인 문서라면 로컬 처리가 올바른 기본값이지만, 대가가 전혀 없는 것은 아닙니다. 솔직한 비교입니다.

항목이 도구(브라우저 내)업로드 방식 OCR 도구
파일이 가는 곳기기를 절대 벗어나지 않음원격 서버로 업로드됨
오프라인 사용가능(최초 로드 이후)불가
용량 제한기기 메모리에 좌우됨서비스 요금제에 좌우됨
계정 필요불필요용량이 크면 대체로 필요
초대형 PDF 속도느림 — 내 CPU를 씀빠름 — 그쪽 서버를 씀
까다로운 스캔 정확도깨끗한 인쇄물엔 양호대체로 더 나음 — 상용 엔진

마지막 두 줄은 사실입니다. 1998년의 구겨진 팩스라면 잘 다듬어진 상용 OCR 서비스가 오픈소스 엔진을 이기고, 500쪽짜리 파일이라면 서버 팜이 노트북보다 항상 빠릅니다. 문서가 민감하지 않고 나쁜 스캔에서의 정확도가 프라이버시보다 중요하다면 그런 서비스를 쓰는 편이 낫습니다.

OCR 정확도를 최대로 끌어올리는 법

PDF OCR의 품질은 버튼을 누르기 전에 대부분 결정됩니다. 다음 네 가지가 차이의 거의 전부를 설명합니다.

  1. 1

    300 DPI 이상으로 스캔하기

    단일 요인으로 가장 큰 영향을 미칩니다. 150 DPI에서는 글자 가장자리가 뭉치기 시작하고, 72 DPI에서는 대부분의 엔진이 추측에 의존합니다. 300 DPI가 문자 인식의 표준 기준값입니다.

  2. 2

    먼저 기울기를 잡고 정리하기

    단 2도만 기울어도 정확도가 눈에 띄게 떨어집니다. 비뚤어진 스캔에는 기울기 보정을, 회색빛이 돌거나 반점이 있는 스캔에는 배경 제거를 켜세요.

  3. 3

    한 번에 한 언어만

    언어 팩을 섞으면 정확도가 희석됩니다. 대부분 영어이고 프랑스어 이름이 몇 개 섞인 문서라면 영어로 처리하세요.

  4. 4

    텍스트 레이어를 확인한 뒤 다시 실행

    내려받기 전에 강조된 단어를 살펴보세요. 어떤 페이지가 빨간 상자로 가득하다면 언어나 스캔 설정을 바꿔 다시 돌리면 됩니다. 비용은 들지 않습니다.

모든 도구는 100% 무료이며 안전합니다

완벽한 PDF 도구 모음

문서 작업에 필요한 모든 기능을 갖춘 종합 PDF 도구 모음을 만나보세요

도구 목록 · 34
01

PNG를 PDF로

여러 PNG 이미지를 인쇄 가능한 하나의 PDF로 묶기

Avg 1.2s로컬
02

JPG를 PDF로

JPG 이미지를 PDF 형식으로 변환

Avg 1.4s로컬
03

PDF 합치기

여러 PDF 파일을 하나로 합치기

Avg 0.8s로컬
04

PDF 압축

PDF 파일 용량을 효율적으로 줄이기

Avg 2.1s로컬
05

PDF를 PNG로

PDF 페이지를 PNG 이미지로 변환

Avg 1.6s로컬
06

PDF를 JPG로

PDF 페이지를 JPG 이미지로 변환

Avg 1.5s로컬
07

PDF 텍스트 추출

PDF 파일에서 텍스트 추출

Avg 0.9s로컬
08

PDF 나누기

PDF를 페이지별로 나누기

Avg 0.6s로컬
09

PDF 편집

PDF 문서 편집 및 주석 추가

Beta로컬
10

PDF 페이지 정리

PDF 페이지 정리 및 순서 변경

Avg 0.7s로컬
11

PDF 회전

PDF 페이지를 회전해 영구 저장

Avg 0.5s로컬
12

페이지 번호

PDF에 페이지 번호를 추가해 영구 저장

Avg 0.6s로컬
13

PDF 워터마크

실시간 미리보기로 PDF에 텍스트 워터마크 추가

Avg 0.6s로컬
14

HEIC를 JPG로

아이폰 HEIC 사진을 JPG로 변환

Avg 1.0s로컬
15

PDF 페이지 삭제

불필요한 페이지를 제거하고 깔끔한 PDF로 다운로드

Avg 0.5s로컬
16

PDF 페이지 추출

선택한 페이지를 새 PDF 또는 개별 파일로 저장

Avg 0.5s로컬
17

PDF 서명

서명을 그리거나 입력하거나 업로드해 원하는 페이지에 배치하세요

Avg 1.0s로컬
18

PDF 크기 조정

페이지 크기를 A4, 레터(Letter) 또는 맞춤 치수로 변경

Avg 0.6s로컬
19

PDF 자르기

PDF 페이지의 여백을 잘라내고 표시 영역만 남기기

Avg 0.6s로컬
20

PDF 병합

양식을 읽기 전용으로 — 텍스트는 검색 가능하게 유지하거나 이미지로 잠그기

Avg 0.7s로컬
21

PDF 메타데이터

작성자, 제목, 날짜 및 기타 메타데이터 보기, 편집 또는 삭제

Avg 0.4s로컬
22

PDF 흑백 변환

그레이스케일 또는 흑백으로 변환해 컬러 잉크 절약

Avg 1.8s로컬
23

PDF에서 이미지 추출

PDF에 포함된 사진을 추출해 PNG 또는 JPG로 저장

Avg 0.9s로컬
24

WebP를 PDF로

WebP 이미지를 PDF로 변환하고 여러 장을 하나의 파일로 합치기

Avg 0.7s로컬
25

PDF 암호 설정

브라우저에서 바로 PDF에 열기 암호를 설정하세요

Avg 0.3s로컬
26

PDF 암호 해제

알고 있는 암호나 제한을 브라우저에서 바로 PDF에서 제거하세요

Avg 1.5s로컬
27

HEIC를 PDF로

아이폰 HEIC 사진을 PDF로 변환

Avg 0.8s로컬
28

AVIF를 PDF로

AVIF 이미지를 PDF로 변환

Avg 0.7s로컬
29

TIFF를 PDF로

TIFF 이미지와 스캔을 PDF로 변환

Avg 1.0s로컬
30

BMP를 PDF로

BMP 비트맵 이미지를 PDF로 변환

Avg 0.7s로컬
31

PDF OCR

스캔한 PDF를 검색 가능하게, 모두 브라우저 안에서

Avg 2s/page로컬
32

PDF 마스킹

PDF의 민감한 내용을 완전히 삭제, 모두 브라우저 안에서

Avg 0.3s/page로컬
33

이미지 압축

JPEG·PNG·WebP를 한 번에 압축, 모두 브라우저 안에서

Avg 0.2s로컬
34

이미지 크기 변경

자주 쓰는 프리셋으로 이미지 크기를 한 번에 변경

Avg 0.2s로컬

자주 묻는 질문

스캔본에 PDF OCR을 돌리기 전에 많이들 묻는 것들입니다.

PDF를 무료로 OCR하려면 어떻게 하나요?

위에서 파일을 열고 문서 언어를 고른 뒤 “OCR 실행”을 누르면 됩니다. 모든 처리는 이 브라우저 탭 안에서 이루어지고 비용은 들지 않습니다. 검색 가능한 PDF와 텍스트 파일을 받게 되며, 계정도 페이지 제한도 없습니다.

이 PDF OCR 도구는 정말 무료인가요? 제한은 무엇인가요?

무료이며 페이지 상한도, 워터마크도 없습니다. 비용이 저희 쪽에 발생하지 않기 때문에 할당량을 두지 않습니다. 실제로 일하는 것은 여러분의 기기입니다. 현실적인 한계는 메모리이며, 오래된 휴대폰에서 아주 큰 스캔본을 다루면 부족할 수 있습니다. 그럴 때는 파일 전체 대신 페이지 범위를 지정해 처리하세요.

제 파일이 서버로 업로드되나요?

아니요. PDF는 브라우저를 벗어나지 않습니다. OCR 엔진은 로컬에서 실행되는 WebAssembly입니다. 저희 쪽에서 내려받는 것은 엔진과 언어 팩뿐입니다. 페이지가 로드된 뒤 네트워크를 끊어 보면 확인할 수 있습니다. OCR은 그대로 동작합니다.

PDF OCR의 정확도는 어느 정도인가요?

깨끗한 인쇄 문자에는 매우 좋고, 손글씨나 품질이 나쁜 스캔에는 약합니다. 300 DPI로 스캔한 일반 인쇄 문자는 보통 90%대의 정확도를 보입니다. 손글씨, 색이 바랜 팩스 용지, 빽빽한 표, 저해상도 사진에서는 빠르게 나빠집니다. 평균치를 믿기보다 텍스트 레이어 보기로 여러분의 문서를 직접 판단하세요.

OCR로 스캔한 PDF를 Word로 변환할 수 있나요?

직접은 안 됩니다. 이 도구는 검색 가능한 PDF와 순수 텍스트를 만들며 .docx는 만들지 않습니다. 대부분의 경우 실제로 필요한 것은 텍스트 내보내기이며, 문서에 그대로 붙여 넣을 수 있습니다. 텍스트만 필요하다면 저희 PDF를 텍스트로 변환하는 도구가 그 용도를 담당합니다.

PDF OCR은 어떤 언어를 지원하나요?

라틴·키릴·CJK 문자를 아우르는 11개 언어입니다. 영어, 중국어 간체와 번체, 스페인어, 포르투갈어, 독일어, 프랑스어, 이탈리아어, 일본어, 한국어, 러시아어. 비라틴 문자에도 완전한 텍스트 레이어가 들어가므로 중국어와 러시아어 스캔본도 일부만이 아니라 제대로 검색됩니다.

왜 처음 실행할 때가 더 느린가요?

첫 실행에서 OCR 엔진과 언어 팩을 내려받기 때문입니다. 그다음부터는 둘 다 브라우저에 캐시되어 곧바로 시작되고 네트워크 없이도 동작합니다. 새 언어로 바꿀 때만 그 언어 팩을 한 번 내려받습니다.

PDF에 OCR을 적용한 다음에는 무엇을 하면 되나요?

대개는 압축하거나 텍스트를 뽑아냅니다. 텍스트 레이어는 페이지당 몇 KB만 늘리지만, 그 아래 스캔 이미지는 대체로 큽니다. 나중에 압축하면 검색 기능은 유지하면서 파일 크기를 줄일 수 있습니다.

관련 도구

같은 문서로 해 볼 만한 다른 작업들입니다.

  • PDF를 텍스트로 이미 텍스트 레이어가 있는 PDF에서 글자를 뽑아냅니다.
  • PDF 압축 OCR 후 스캔본을 텍스트 레이어를 유지한 채 가볍게 만듭니다.
  • PDF를 PNG로 다시 스캔하기 전에 손볼 수 있도록 페이지를 이미지로 내보냅니다.
  • PDF 흑백 변환 지저분한 스캔본의 색을 빼면 인식률이 좋아지는 경우가 많습니다.
  • PDF 병합 여러 스캔 페이지를 한 문서로 합친 뒤 한꺼번에 OCR을 돌립니다.
  • PDF 마스킹 스캔본이 검색 가능해진 뒤 민감한 내용을 완전히 지우세요.

스캔본을 검색 가능하게 만드세요

바로 이 브라우저에서 PDF에 OCR을 실행하세요. 업로드도, 계정도, 페이지 제한도 없습니다.

PDF OCR 도구 열기
무료 PDF OCR — 스캔한 PDF를 검색 가능하게